Anthropic restaura Claude Fable 5 después de que Estados Unidos levantara los controles de exportación vinculados al jailbreak – CYBERDEFENSA.MX

Antrópico es poner Claude Fábula 5 nuevamente en línea en todo el mundo. En 30 de junioel Departamento de Comercio de Estados Unidos levantó los controles de exportación que había impuesto a Fable y su hermano Mythos 5, más controlado, aproximadamente dos semanas y media antes.

Fable 5 regresa a los usuarios el miércoles 1 de julio en Claude.ai, Claude Platform, Claude Code y Claude Cowork.

Los controles de exportación restringen quién puede recibir o utilizar una tecnología. La orden del 12 de junio le ordenó a Anthropic que cortara ambos modelos para cualquier ciudadano extranjero, dentro o fuera de los Estados Unidos, incluido su propio personal no ciudadano.

La regla entró en vigor de inmediato y la compañía no tenía una forma confiable de verificar la nacionalidad de cada usuario en tiempo real, por lo que cerró ambos modelos para todos.

El detonante fue un jailbreak: un aviso que hace que un modelo eluda sus reglas de seguridad. Los investigadores de Amazon encontraron uno en Fable 5. Según Anthropic, el mensaje hizo que el modelo señalara algunas fallas de software y, en un caso, escribiera código que mostrara cómo se podía abusar de una falla.

Anthropic restó importancia al hallazgo. Dice que las mismas solicitudes también funcionan en muchos modelos más débiles, incluido su propio Claude Opus 4.8, el GPT-5.5 de OpenAI y el Kimi K2.7 de China. La compañía llama al comportamiento señalado un trabajo de seguridad defensiva de rutina, no una supercapacidad oculta.

El gobierno y el socio que informó sobre la fuga lo consideraron lo suficientemente grave como para justificar controles de emergencia.

Ciberseguridad

Para resolver la preocupación, Anthropic entrenó un nuevo filtro de seguridad, llamado clasificadorque busca la técnica exacta en el informe y la bloquea. La compañía dice que ahora detiene esa técnica en más del 99% de los intentos, según el artículo del 30 de junio. Las solicitudes bloqueadas se entregan al Opus 4.8 más débil y se le informa al usuario. La compensación es que habrá más falsas alarmas en la codificación y depuración normales.

Mythos 5, el mismo modelo subyacente con menos barandillas de seguridad, mantiene una correa más corta. El acceso regresó el 26 de junio para aproximadamente 100 empresas y agencias federales estadounidenses que defienden la infraestructura crítica. Anthropic dice que todavía está trabajando con el gobierno para ampliar el acceso.

El secretario de Comercio, Howard Lutnick, quien aprobó la reversión, dijo que su departamento había pasado dos semanas revisando los modelos con Anthropic. En su carta, la compañía acordó buscar problemas de seguridad por su cuenta, coordinar lanzamientos futuros e informar cualquier uso malicioso que detecte.

Según se informa, las negociaciones fueron dirigidas por el cofundador Tom Brown y no por el director ejecutivo Dario Amodei, quien ha chocado con la administración durante gran parte del año.

La pelea fue complicada desde el principio. Múltiples informes, incluido el de The Wall Street Journal, dijeron que la investigación de Amazon y las preocupaciones del director ejecutivo Andy Jassy ayudaron a impulsar el pedido original. Ex zar de la IA David Sacos acusó a Anthropic de haber «priorizado la oferta continua del modelo de consumo por encima de la seguridad». Otros lo interpretan como una sobrecorrección.

El investigador de gobernanza de IA de la Universidad de Sydney, Francesco Bailo, dijo a Al Jazeera que la reversión parecía como si el gobierno hubiera admitido que había ido demasiado lejos, y un grupo de líderes de seguridad había firmado una carta abierta pidiendo que se levantaran los controles.

Sobre todo ello flotaba la competencia. La pausa se produjo justo cuando los modelos chinos de código abierto baratos y capaces estaban ganando terreno, y varios ejecutivos advirtieron que congelar los modelos estadounidenses les daba a los rivales tiempo libre para ponerse al día.

Anthropic también propone algo de lo que carecía la industria: una forma compartida de clasificar qué tan peligroso es realmente un jailbreak. Con Amazon, Microsoft, Google y otros socios, quiere calificar a cada uno en cuatro aspectos:

  • Ganancia de capacidad: hasta qué punto el jailbreak lleva a un usuario más allá de las herramientas que ya tiene.
  • Amplitud: cuántos ataques diferentes desbloquea el mismo truco.
  • Facilidad de armamento: cuánta habilidad y esfuerzo se necesita para convertirlo en un ataque real.
  • Descubribilidad: Qué fácil es encontrar o copiar el truco.

Para los peores casos, como un jailbreak que permite ataques a redes eléctricas o bancos, Anthropic dice que comenzará a implementar correcciones en el momento en que se confirme la gravedad, y está formando un equipo para observar los informes de jailbreak las 24 horas del día.

Ciberseguridad

También abrió un programa hackerone para que los investigadores informen sobre nuevas fugas de Fable 5, y prometió al gobierno de EE. UU. acceso temprano para probar futuros modelos fronterizos antes de su lanzamiento.

Anthropic no es el único laboratorio en esta posición. Días antes, OpenAI presentó GPT-5.6 a un pequeño grupo aprobado por el gobierno en lugar de al público, citando la misma preocupación de doble uso: un modelo lo suficientemente bueno como para ayudar a los defensores a corregir errores también es lo suficientemente bueno para ayudar a los atacantes a encontrarlos.

El riesgo no es hipotético. A principios de esta primavera, Anthropic probó un modelo anterior de Mythos que encontró y explotó errores de día cero en todos los principales sistemas operativos y navegadores bajo comando, incluida una falla de 27 años en OpenBSD. Su equipo rojo convirtió errores recién revelados en exploits funcionales en menos de un día.

La crisis inmediata ha terminado. La pregunta más importante no es. A orden ejecutiva del 2 de junio creó un camino voluntario para que las empresas revisen los modelos de frontera antes de su lanzamiento. También estableció un punto de referencia clasificado para decidir qué modelos cuentan como «cubiertos», al tiempo que descarta cualquier licencia obligatoria para enviar uno. Fable 5 nunca pasó por ese camino.

En cambio, el gobierno recurrió a controles de exportación. Ésa es la cuestión: cuando Washington quiere avanzar rápidamente sobre un modelo fronterizo, todavía no tiene ningún proceso vinculante, sólo procesos improvisados.

Los fallos de AirDrop y Quick Share permiten que los atacantes cercanos provoquen bloqueos y eludan controles – CYBERDEFENSA.MX

Dos investigadores han encontrado seis fallos de seguridad en Entrega por paracaídas y Compartir rápidolas funciones inalámbricas que transmiten archivos entre dispositivos cercanos sin cables ni red compartida.

Un atacante dentro del alcance inalámbrico, con solo una computadora portátil y sin conexión previa, puede bloquear el servicio compartido en una Mac o iPhone configurado para recibir de cualquier persona, sin toque ni aviso.

La misma investigación encontró fallas en Quick Share que eluden las comprobaciones de sesión de Samsung y provocan un bloqueo potencialmente explotable en la aplicación de Windows de Google.

Las dos funciones se ejecutan dentro de un ecosistema de más de cinco mil millones de dispositivos Apple y Android activos, aunque los errores probados afectan a implementaciones y versiones específicas.

La obra, planteada en un nuevo trabajo de investigación por Arash Ale Ebrahim y Nils Ole Tippenhauer del Centro CISPA Helmholtz para la Seguridad de la Información, es el primero en separar ambas pilas una al lado de la otra, por encima de la capa de radio, donde el descubrimiento se convierte en manejo de sesiones, análisis y decisiones de confianza.

Los arreglos ya comenzaron. Apple corrigió uno de los tres errores de AirDrop y le asignó un CVE, aunque el aviso aún no es público; los otros dos aún se encuentran en divulgación coordinada. Google pagó una recompensa por la falla de Windows y consiguió una corrección de código, con su CVE aún pendiente.

Ciberseguridad

Los dos errores de Samsung fueron entregados a Google y siguen bajo investigación. Al momento de escribir este artículo, no ha surgido ningún informe público sobre la explotación de estas fallas.

Tres formas de acabar con el intercambio de Apple

Las tres fallas de AirDrop terminan en el mismo fallo: eliminan el servicio compartido, el servicio en segundo plano en macOS e iOS que maneja AirDrop. El problema es que este servicio también ejecuta AirPlay, Handoff, Universal Clipboard, Continuity Camera y NameDrop, por lo que una falla destruye todo el conjunto.

El más simple de los tres solo necesita una única solicitud con formato incorrecto enviada a un dispositivo con AirDrop configurado para recibir de «Todos». Envíe esos mensajes de fallo en bucle, aproximadamente uno cada dos segundos, y las funciones permanecerán inactivas mientras el atacante continúe. En la prueba de los investigadores, no se realizó ninguna transferencia AirDrop legítima mientras se ejecutaba el ataque.

Dos de los tres son más que errores de AirDrop, porque viven en marcos compartidos de Apple. El más amplio es un desbordamiento de pila en el analizador de listas de propiedades XML de Foundation, provocado por un pequeño archivo con alrededor de 200 capas anidadas.

Cualquier aplicación de Apple que abra un archivo de ese tipo que no sea de confianza podría acceder a la misma ruta del analizador en macOS, iOS, watchOS, tvOS y visionOS. Los investigadores reprodujeron los fallos de AirDrop en macOS 15.7.4, macOS 26.3, iOS 18.x e iOS 26.3; una versión anterior de iOS 16 no se vio afectada.

Los errores de Quick Share y una solución que falló

En Android, dos fallas en Quick Share de Samsung permitieron a un atacante saltarse el apretón de manos que se supone bloquea una sesión. Se permite que un dispositivo no verificado comience a controlar la conexión antes de que se configure cualquier cifrado.

El otro permite que algunos mensajes de control pasen sin cifrar incluso después de que exista una sesión segura. Un atacante en la misma red Wi-Fi podría usar esa brecha para forzar una conexión a un estado «aceptada», mantenerla viva o hacer que el servidor devuelva valores de IP y puerto proporcionados por el atacante. Ninguno de ellos roba archivos, pero ambos anulan las protecciones que promete el sistema.

Los investigadores los probaron en un Galaxy S23 Ultra y notaron que las versiones de Quick Share de otros fabricantes de Android necesitan una verificación por separado.

La falla más grave está en Quick Share de Google para Windows. Es un error de memoria que surge cuando dos conexiones chocan en el instante correcto, dejando al programa usando una porción de memoria que ya ha desperdiciado.

Ese es el tipo de error que a veces puede convertirse en la ejecución de código atacante, y los investigadores dicen que la ruta es plausible aquí porque una defensa de Windows llamada Control Flow Guard está desactivada en la aplicación.

Confirmaron un fallo pero no crearon un exploit que funcionara. Google lo reconoció, pagó una recompensa y ahora consiguió una solución; el CVE aún está pendiente.

No es la primera vez que Quick Share para Windows está aquí. SafeBreach informó un Cadena de ejecución de código de 10 errores en 2024 (CVE-2024-38271 y CVE-2024-38272), luego regresó en 2025 para evitar las correcciones de Google (CVE-2024-10668). El nuevo uso después de la liberación agrega otra entrada a un patrón del mismo componente que se parchea y prueba nuevamente.

Ciberseguridad

El detalle que duele: el propio código fuente del programa contenía un comentario que admitía un error anterior en ese lugar exacto, que decía «Tuvimos un error aquí, causado por una carrera con EncryptionRunner». La solución escrita para solucionarlo reintrodujo el mismo tipo de falla.

El riesgo es local, no remoto

El límite clave es el alcance. Se trata de ataques locales, no de Internet: el atacante debe estar a una distancia de entre 10 y 30 metros o en la misma red local.

Si bien es menos radical que un error remoto, un solo atacante en un lugar concurrido como un aeropuerto, un tren o una conferencia aún puede llegar a muchos dispositivos a la vez. Los investigadores probaron sólo su propio hardware y han lanzaron sus herramientas abiertamente para que otros equipos de seguridad puedan reproducir los hallazgos.

En una Mac o iPhone, instale la última actualización de Apple (iOS y macOS 26.5.2 se enviaron el 29 de junio) y mantenga AirDrop en «Solo contactos» o desactivado en lugar de «Todos», que es la configuración que necesitan estas fallas. En Quick Share, déjelo fuera de la visibilidad de «Todos» cuando no esté recibiendo activamente un archivo y actualice la aplicación de Windows ahora que la solución de Google ha llegado.

Dos sistemas construidos de forma independiente fallaron de la misma manera: fallas en el código que se dirige a la red y controles de seguridad integrados en manejadores de mensajes individuales en lugar de aplicarse desde el principio. También llega en un momento incómodo.

La interoperabilidad AirDrop de Google para Quick Share ya se está implementando en los principales teléfonos Android, y solo funciona cuando el iPhone está configurado para recibir de «Todos», la configuración exacta que expone los errores de falla de AirDrop.

npm agrega controles de instalación de paquetes y publicación controlados por 2FA contra ataques a la cadena de suministro – CYBERDEFENSA.MX

GitHub ha implementado nuevos controles para npm para mejorar la seguridad de la cadena de suministro de software, brindando a los mantenedores la capacidad de aprobar explícitamente una versión antes de que los paquetes estén disponibles públicamente para su instalación.

La función, denominada publicación por etapas, ahora está disponible de forma generalizada en npm. Exige que un mantenedor humano pase un desafío de autenticación de dos factores (2FA) para aprobar un paquete antes de enviarlo a npmjs.[.]com.

«En lugar de una publicación directa que pone inmediatamente a disposición de los consumidores una versión del paquete, el tarball prediseñado se carga en una cola de espera donde un responsable de mantenimiento debe aprobarlo explícitamente antes de que sea instalable», GitHub dicho.

La subsidiaria propiedad de Microsoft dijo que el cambio garantiza una «prueba de presencia» para cada publicación, incluidas aquellas que provienen de flujos de trabajo CI/CD no interactivos y publicaciones confiables con autenticación OpenID Connect (OIDC).

Antes de usar publicación en escenalos mantenedores de paquetes deben cumplir los siguientes criterios:

  • Tener acceso de publicación al paquete.
  • El paquete ya existe en el registro npm, lo que significa que no se puede preparar un paquete nuevo
  • 2FA está habilitado para la cuenta

Los desarrolladores pueden utilizar el comando «npm stage Publish» desde el directorio raíz del paquete para enviarlo a un área de preparación. Para utilizar este comando, es esencial actualizar a npm CLI 11.15.0 o posterior. Para una protección óptima, GitHub recomienda que la publicación por etapas se combine con publicación confiable utilizando OIDC.

Ciberseguridad

Una segunda actualización centrada en npm se relaciona con la introducción de tres nuevos indicadores de fuente de instalación junto con el indicador existente -allow-git –

  • –allow-file: Controla las instalaciones desde rutas de archivos locales y archivos tar locales
  • –allow-remote: controla las instalaciones desde URL remotas, incluidos archivos tar https
  • –allow-directory: Controla las instalaciones desde directorios locales

Las banderas permiten a los desarrolladores «aplicar el mismo enfoque de lista permitida explícita a cada fuente de instalación que no sea del registro», dijo GitHub.

El desarrollo se produce en medio de un aumento masivo de ataques a la cadena de suministro de software dirigidos a ecosistemas de código abierto en los últimos meses, con un grupo cibercriminal conocido como TeamPCP involucrado en envenenar paquetes populares a una escala sin precedentes a través de un ciclo de compromisos que se perpetúa a sí mismo.