Google lanza Gemini 3.5 Flash Cyber ​​AI para encontrar y reparar vulnerabilidades de software – CYBERDEFENSA.MX

DeepMind de Google anunció el martes el lanzamiento de Géminis 3.5 Flash Cyberun modelo de inteligencia artificial (IA) especializado construido sobre Flash 3.5 que está diseñado para descubrir, validar y parchear vulnerabilidades de manera rápida y eficiente.

Según el gigante tecnológico, el modelo estará disponible exclusivamente para gobiernos y socios confiables a través de CodeMender como parte de un programa piloto de acceso limitado. CodeMender es un agente impulsado por inteligencia artificial para el descubrimiento y parcheo de vulnerabilidades que fue presentado por la compañía en octubre de 2025.

Un portavoz de Google DeepMind dijo a The Hacker News que hay planes para ampliar las capacidades del modelo para incluir funciones de equipo rojo y defensa empresarial de extremo a extremo.

El modelo liviano, según DeepMind, es una alternativa rentable y altamente capaz a los modelos grandes y costosos centrados en la ciberseguridad. CodeMender puede recurrir a 3.5 Flash Cyber ​​»varias veces a alta velocidad y bajo costo», lo que permite al agente de IA escanear más rutas de código y encontrar vulnerabilidades.

Ciberseguridad

Llega el lanzamiento de 3.5 Flash Cyber Gemini 3.6 Flash y 3.5 Flash-Liteque están optimizados para mejorar la codificación, el trabajo del conocimiento y el rendimiento multimodal y tareas de baja latencia, respectivamente.

«Dada la naturaleza de doble uso de esta tecnología, hemos adoptado un enfoque intencional sobre cómo implementar 3.5 Flash Cyber», Raluca Ada Popa, líder de seguridad Gemini de DeepMind, y Four Flynn, vicepresidente de seguridad y privacidad de DeepMind, dicho en una publicación de blog compartida con The Hacker News antes de su publicación.

«Como parte de un programa piloto de acceso limitado, 3.5 Flash Cyber ​​estará disponible exclusivamente para gobiernos y socios confiables a través de CodeMender, y se expandirá con el tiempo. Esto dará a los defensores de primera línea una ventaja para encontrar y corregir vulnerabilidades críticas antes de que puedan ser explotadas, al mismo tiempo que se mitiga contra un uso indebido más amplio».

Dado que 3.5 Flash Cyber ​​se ejecuta únicamente dentro de CodeMender, es fácil establecer barreras de seguridad que habiliten las funciones de defensa del agente de IA y al mismo tiempo deshabiliten otras actividades cibernéticas, añadió el portavoz. Esto es para evitar escenarios en los que un modelo se niega a manejar escenarios que prohibir a los defensores realizar análisis forenses asistidos por IA.

En evaluaciones realizadas por el laboratorio de investigación de IA, se descubrió que 3.5 Flash Cyber ​​supera a Gemini 3.5 Flash y 3.6 Flash cuando se trata de descubrir nuevas vulnerabilidades en las bases de código. Pruebas de estrés adicionales del modelo en proyectos complejos como Google Chrome y Apple Safari han revelado que ha superado «significativamente» a Gemini 3.5 Flash, 3.6 Flash y Anthropic Claude Opus 4.6.

«3.5 Flash Cyber ​​descubrió constantemente más vulnerabilidades únicas en comparación con 3.5 Flash y Claude Opus 4.6», señaló. «Cuando se probó en el motor JavaScript V8 altamente complejo a través de un número fijo de invocaciones, Gemini 3.5 Flash Cyber ​​encontró 55 problemas únicos confirmados, en comparación con 47 encontrados por Gemini 3.5 Flash y 36 encontrados por Opus 4.6, incluidos 10 problemas que ningún otro modelo detectó».

Ciberseguridad

Como en el caso de Anthropic y OpenAI, Google ha puesto a prueba 3.5 Flash Cyber ​​para descubrir vulnerabilidades de ejecución remota de código en API públicas y una vulnerabilidad de corrupción de memoria en un servicio de producción sensible. También se dice que el modelo produjo un exploit de ejecución remota de código 100% confiable que evitó técnicas de mitigación estándar como Address Space Layout Randomization (ASLR) y Write XOR Execute (W^X).

Google dijo que traerá por separado las capacidades fundamentales de CodeMender directamente a los clientes con modelos Gemini disponibles de forma general a través de Plataforma de agentes empresariales Gemini.

«Al potenciar CodeMender con 3.5 Flash Cyber, proporcionamos una arquitectura altamente capaz, escalable y asequible diseñada para ayudar a más defensores a proteger el software», añadió.

EE.UU. lanza una iniciativa para centralizar la solución de vulnerabilidades en infraestructuras críticas – CYBERDEFENSA.MX

El Gobierno de EE.UU. ha anunciado el lanzamiento de Gold Eagle, un centro de intercambio de información para recibir y corregir vulnerabilidades con mayor rapidez y desarrollar una respuesta rápida y priorizada a estas fallas en sus sectores de infraestructuras críticas.

Desde el lado público la iniciativa tiene el apoyo de La Casa Blanca, el Departamento del Tesoro, el Departamento de Seguridad Nacional (DHS) a través de la Agencia de Seguridad de Infraestructura y Ciberseguridad (CISA) y el Departamento de Guerra (DOW).

Este nuevo sistema coordinado busca reducir los esfuerzos de escaneo duplicados y proporcionar información priorizada y práctica sobre amenazas y soluciones a los responsables de la defensa en todo el gobierno federal y el sector privado.

A la orden

Gold Eagle ha sido establecido mediante una orden ejecutiva de Trump titulada ‘Promoción de la Innovación y la Seguridad en Inteligencia Artificial Avanzada’, firmada el 2 de junio. Esta exigía la creación de un centro de intercambio de información habilitado por IA que se materializa con esta iniciativa.

El programa ya ha comenzado a recopilar y priorizar las vulnerabilidades de ciberseguridad identificadas en todos los sectores e industrias.

«Codo con codo con los innovadores más brillantes de EE.UU., estamos allanando el camino hacia un futuro aún más prometedor y consolidando el dominio estadounidense en IA para las generaciones venideras. Juntos, seguiremos protegiendo el ingenio estadounidense y garantizando la seguridad de los sistemas críticos de nuestra nación», ha declarado el director nacional de Ciberseguridad, Sean Cairncross.

«Gold Eagle es la vanguardia de la ciberdefensa estadounidense. Estamos aprovechando la inteligencia artificial de última generación, junto con los mejores innovadores estadounidenses, para salvaguardar nuestra infraestructura crítica y proteger la patria», ha comentado Pete Hegseth, secretario de Guerra.

Este lanzamiento llega poco tiempo después de que la administración Trump haya levantado las restricciones sobre los últimos modelos de Anthropic debido a preocupaciones de ciberseguridad. Poco después se emitieron informes que apuntaban a que CISA estaba usando Mythos para auditar el software gubernamental para encontrar vulnerabilidades, como informa Security Week. 

El Gobierno de EE.UU. ha anunciado el lanzamiento de Gold Eagle, un centro de intercambio de información para recibir y corregir vulnerabilidades con mayor rapidez y desarrollar una respuesta rápida y priorizada a estas fallas en sus sectores de infraestructuras críticas.

El programa ha sido impulsado por la administración Trump (quien usará las facultades y recursos existentes del gobierno federal) en colaboración con socios de software de código abierto y compañías de infraestructuras críticas estadounidenses. 

Desde el lado público la iniciativa tiene el apoyo de La Casa Blanca, el Departamento del Tesoro, el Departamento de Seguridad Nacional (DHS) a través de la Agencia de Seguridad de Infraestructura y Ciberseguridad (CISA) y el Departamento de Guerra (DOW).

Este nuevo sistema coordinado busca reducir los esfuerzos de escaneo duplicados y proporcionar información priorizada y práctica sobre amenazas y soluciones a los responsables de la defensa en todo el gobierno federal y el sector privado.

A la orden

Gold Eagle ha sido establecido mediante una orden ejecutiva de Trump titulada ‘Promoción de la Innovación y la Seguridad en Inteligencia Artificial Avanzada’, firmada el 2 de junio. Esta exigía la creación de un centro de intercambio de información habilitado por IA que se materializa con esta iniciativa.

El programa ya ha comenzado a recopilar y priorizar las vulnerabilidades de ciberseguridad identificadas en todos los sectores e industrias.

«Codo con codo con los innovadores más brillantes de EE.UU., estamos allanando el camino hacia un futuro aún más prometedor y consolidando el dominio estadounidense en IA para las generaciones venideras. Juntos, seguiremos protegiendo el ingenio estadounidense y garantizando la seguridad de los sistemas críticos de nuestra nación», ha declarado el director nacional de Ciberseguridad, Sean Cairncross.

«Gold Eagle es la vanguardia de la ciberdefensa estadounidense. Estamos aprovechando la inteligencia artificial de última generación, junto con los mejores innovadores estadounidenses, para salvaguardar nuestra infraestructura crítica y proteger la patria», ha comentado Pete Hegseth, secretario de Guerra.

Un investigador lanza una nueva PoC de día cero para Windows horas después del parche de Microsoft el martes – CYBERDEFENSA.MX

investigador de seguridad Eclipse caótico (también conocido como Pesadilla-Eclipse) tiene liberado un nuevo exploit de prueba de concepto (PoC) llamado LegacyHive.

Se ha descrito como una vulnerabilidad de elevación de privilegios de carga de colmena arbitraria del Servicio de perfiles de usuario de Windows. El Servicio de perfiles de usuario de Windows, también conocido como ProfSvc, es un componente central del sistema que administra entornos y cuentas de usuario.

«La PoC requiere otra credencial de usuario estándar y un tercer nombre de usuario (que puede ser una cuenta de administrador)», Chaotic Eclipse dicho. «Si la prueba de concepto tiene éxito, terminará montando la colmena de usuarios de destino en la raíz de clases de usuarios actuales».

El investigador dijo que el exploit fue eliminado para evitar la explotación pública, añadiendo que el exploit original no requería credenciales de usuario adicionales y no se limitaba a la colmena «usrclass.dat».

«Cualquier colmena podría cargarse utilizando esta vulnerabilidad, pero se necesitarían algunas células cerebrales para que el PoC lo hiciera», señaló el investigador.

Lo que lo hace notable es que es funcional en todas las versiones de escritorio y servidor compatibles de Windows, incluidas aquellas que ejecutan la última actualización del martes de parches de julio de 2026.

Ciberseguridad

Chaotic Eclipse y Microsoft han estado envueltos en una acalorada disputa desde al menos abril de 2026, y el investigador publicó detalles de múltiples exploits antes de que el fabricante de Windows tuviera la oportunidad de parchearlos, citando una falla en la comunicación. Tres de las vulnerabilidades de Microsoft Defender fueron explotadas activamente poco después de su divulgación pública.

A principios de este mes, el gigante tecnológico publicó actualizaciones de seguridad para otra vulnerabilidad de Defender conocida como RoguePlanet que fue revelada por el investigador. Sin embargo, resultó que las «actualizaciones de defensa en profundidad» recientemente introducidas para abordar la falla pueden hacer que Microsoft Defender filtre 8 bytes de datos al intentar abrir un archivo en ciertos escenarios.

microsoft le dijo a The Hacker News que está investigando el nuevo informe. Nos hemos puesto en contacto con la empresa para hacer comentarios sobre LegacyHive y actualizaremos la historia si recibimos una respuesta.

Fallas del servidor SharePoint en primer plano

El desarrollo se produce cuando Microsoft envió parches para un récord de 622 fallas, incluidas dos deficiencias de escalada de privilegios en SharePoint Server (CVE-2026-56164, puntuación CVSS: 5.3) y Servicios de federación de Active Directory (CVE-2026-56155, puntuación CVSS: 7.8) que han sido marcadas como explotadas activamente.

La Agencia de Seguridad de Infraestructura y Ciberseguridad de EE. UU. (CISA) ha agregado ambas vulnerabilidades a sus vulnerabilidades explotadas conocidas (KEV), que exige que las agencias del Poder Ejecutivo Civil Federal (FCEB) apliquen las correcciones antes del 17 y 28 de julio de 2026, respectivamente.

«Después de años de relativa estabilidad, el proceso del martes de parches ha experimentado turbulencias significativas en lo que va de 2026», dijo en un comunicado Adam Barnett, ingeniero jefe de software de Rapid7. «Además del crecimiento exponencial de los informes y descubrimiento de vulnerabilidades impulsado por la IA, Microsoft está lidiando con el surgimiento de una serie de vulnerabilidades reveladas de tal manera que generan la máxima incomodidad para Redmond».

En un aviso separado, la agencia dicho es consciente de la explotación activa de múltiples fallas de SharePoint Server, incluyendo CVE-2026-32201, CVE-2026-45659y CVE-2026-56164, que permiten a los actores de amenazas cibernéticas obtener acceso no autorizado a instancias susceptibles.

Ciberseguridad

«Estas vulnerabilidades afectan a todas las versiones locales compatibles de SharePoint Server (Subscription Edition, 2019 y 2016) e implican el establecimiento de ejecución remota de código (RCE) y actividades posteriores a la explotación, como el robo de claves de máquina de Internet Information Services (IIS) y la realización de técnicas de deserialización, para ganar persistencia e implementar malware», dijo CISA.

«La falla surge de la falta de autenticación para una función crítica, lo que permite a un atacante alcanzar una funcionalidad que debería requerir autorización», dijo Alex Vovk, director ejecutivo y cofundador de Action1, sobre CVE-2026-56164.

«Un atacante puede enviar solicitudes de red especialmente diseñadas para acceder a una funcionalidad que debería requerir autenticación, lo que resulta en una escalada de privilegios. La vulnerabilidad impacta principalmente la integridad del sistema al permitir acciones no autorizadas sin requerir autenticación previa o interacción del usuario. Los servidores SharePoint con acceso a Internet están particularmente expuestos porque el ataque se puede realizar de forma remota sin credenciales válidas».

Vale la pena señalar que la actualización de julio de 2026 también aborda otra vulnerabilidad de omisión de característica de seguridad crítica de SharePoint Server (CVE-2026-55040puntuación CVSS: 9,1) que un atacante remoto no autenticado podría aprovechar para eludir la autenticación en un servidor de SharePoint vulnerable y realizar operaciones como usuario o administrador del sitio de SharePoint.

«La vulnerabilidad se debe a varios problemas en el proceso de validación del token JWT», Rapid7 dicho. «Un atacante que explota con éxito CVE-2026-55040 puede realizar operaciones contra el sitio de SharePoint de destino como el usuario que identifica. Además, esta omisión de autenticación se puede encadenar a vulnerabilidades adicionales dentro de la superficie de ataque autenticada del sitio de destino».

La administración Trump lanza el centro de intercambio de información sobre ciberamenazas de IA 'Gold Eagle'

La administración Trump dio a conocer su nueva cámara de compensación federal para compartir información sobre amenazas cibernéticas de IA entre el gobierno y el sector privado, y dijo que el proyecto ya está recibiendo inteligencia sobre amenazas sobre vulnerabilidades de seguridad cibernética y priorizando la aplicación de parches.

Creada el mes pasado mediante una orden ejecutiva de la Casa Blanca, “Gold Eagle” será administrada por el Departamento del Tesoro, con contribuciones de la Agencia de Seguridad de Infraestructura y Ciberseguridad, el Departamento de Seguridad Nacional y el Departamento de Defensa, así como proveedores de software de código abierto, operadores de infraestructura crítica y la industria.

«Bajo el liderazgo del presidente Trump, el Departamento del Tesoro está trabajando mano a mano con el sector privado para salvaguardar nuestras instituciones financieras, cerrar vulnerabilidades y proteger la integridad del sistema financiero estadounidense», dijo el secretario del Tesoro, Scott Bessent, en un comunicado. «El Tesoro, junto con nuestras agencias asociadas, seguirá aprovechando las capacidades de vanguardia de la IA para adelantarse a nuestros adversarios y defender al pueblo estadounidense de las amenazas emergentes».

Gold Eagle está destinado a ayudar a organizaciones públicas y privadas a encontrar, corregir y parchear vulnerabilidades encontradas utilizando herramientas de inteligencia artificial antes de que sean descubiertas y explotadas por malos actores. El trabajo implicará el uso de IA para encontrar vulnerabilidades de ciberseguridad en los sistemas y software de las víctimas, y el secretario de Seguridad Nacional, Markwayne Mullin, dijo que también exploraría más a fondo formas de aprovechar la tecnología para la ciberdefensa.

Según la Casa Blanca, Gold Eagle ya se ha utilizado para recopilar información sobre vulnerabilidades.

A medida que los modelos de IA han mejorado en la realización de tareas básicas relacionadas con la ciberseguridad (como escanear códigos en busca de vulnerabilidades o desarrollar códigos de explotación de prueba de concepto), los expertos en ciberseguridad y los formuladores de políticas se han preocupado cada vez más. La Internet moderna está plagada de códigos inseguros, configuraciones erróneas y otros errores que pueden identificarse y explotarse más rápido que nunca utilizando herramientas de inteligencia artificial.

Las vulnerabilidades en el software de fuente abierta pueden estar generalizadas y ocultas, ya que muchos productos de software comercial en el mercado dependen de código de fuente abierta pero pocos se molestan en documentarlo. Cuando los piratas informáticos se comprometieron una herramienta de registro en Log4J biblioteca de software Apache de código abierto en 2021, requirió un esfuerzo de coordinación masivo de varios meses por parte de CISA, el sector privado y otras partes interesadas para encontrar y reparar las piezas de software afectadas.

Un funcionario de la Casa Blanca dijo a los periodistas en una rueda de prensa el martes que el trabajo de Gold Eagle refleja el “pleno apoyo” de la administración a los proveedores y mantenedores de software de fuente abierta de Estados Unidos.

Las herramientas de código abierto son “vitales para los sistemas que se ejecutan en todo nuestro país y en la vida diaria”, dijo un alto funcionario de la administración, hablando con periodistas en segundo plano. “Lo mantiene un grupo talentoso de personas y entidades y haremos todo lo posible para apoyar la fuerza de esa comunidad.

Michael Daniel, excoordinador cibernético de la Casa Blanca durante la presidencia de Barack Obama, dijo a CyberScoop que la IA todavía es tan nueva que los formuladores de políticas continúan observando su impacto y adaptándose. Si bien algunos canales de comunicación existentes para compartir información sobre amenazas a la ciberseguridad probablemente podrían duplicarse para rastrear las amenazas de la IA, todavía hay mucho que los formuladores de políticas pueden aprender más sobre la tecnología, el tipo de amenazas que produce y su ecosistema de partes interesadas.

«Al final del día, puede resultar que el phishing sigue siendo phishing, y el hecho de que ahora tenemos herramientas de inteligencia artificial para hacerlo, sigue siendo phishing. O puede haber algo fundamentalmente diferente al respecto que necesitamos descubrir cómo combatirlo y compartir información», dijo.

Derek B. Johnson

Escrito por Derek B. Johnson

Derek B. Johnson es reportero de CyberScoop, donde su área incluye la ciberseguridad, las elecciones y el gobierno federal. Antes de eso, ha brindado una cobertura galardonada de noticias sobre ciberseguridad en los sectores público y privado para varias publicaciones desde 2017. Derek tiene una licenciatura en periodismo impreso de la Universidad de Hofstra en Nueva York y una maestría en políticas públicas de la Universidad George Mason en Virginia.

Cisco lanza actualizaciones de seguridad para una falla de SD-WAN Manager activamente explotada – CYBERDEFENSA.MX

Cisco ha publicado actualizaciones de seguridad para una falla de seguridad de gravedad media en Catalyst SD-WAN Manager que ha sido objeto de explotación activa en la naturaleza.

La vulnerabilidad, rastreada como CVE-2026-20262tiene una puntuación CVSS de 6,5 sobre 10,0.

«Una vulnerabilidad en la interfaz de usuario web de Cisco Catalyst SD-WAN Manager, anteriormente SD-WAN vManage, podría permitir a un atacante remoto autenticado crear un archivo o sobrescribir cualquier archivo en el sistema de archivos de un sistema afectado», Cisco dicho en un aviso.

El problema, añadió la empresa de equipos de red, se debe a una validación inadecuada de los datos proporcionados por el usuario durante el proceso de carga de archivos. Un atacante podría aprovechar este comportamiento para crear o sobrescribir cualquier archivo en el sistema operativo subyacente enviando solicitudes HTTP diseñadas a un punto final API afectado.

Esto, a su vez, podría convertirse en un arma para llegar a la raíz. Sin embargo, una explotación exitosa depende de que el atacante ya tenga credenciales válidas con al menos acceso de escritura.

Ciberseguridad

La vulnerabilidad afecta a los siguientes productos independientemente del tipo de implementación:

  • Cisco Catalyst SD-WAN Manager local
  • Cisco SD-WAN Cloud-Pro
  • Nube Cisco SD-WAN (administrada por Cisco)
  • Cisco SD-WAN para gobierno (FedRAMP)

Se han lanzado parches para solucionar el problema.

  • Cisco Catalyst SD-WAN versión 20.9.9.1 y anteriores: corregido en 20.9.9.2
  • Cisco Catalyst SD-WAN versión 20.12.7.1 y anteriores: corregido en 20.12.7.2
  • Cisco Catalyst SD-WAN versión 20.15.4.4 y anteriores: corregido en 20.15.4.5
  • Cisco Catalyst SD-WAN versión 20.15.5.2 y anteriores: corregido en 20.15.5.3
  • Cisco Catalyst SD-WAN versión 20.18.3: corregido en 20.18.3.1
  • Cisco Catalyst SD-WAN versión 26.1.1.1 y anteriores: corregido en 26.1.1.2

Cisco dijo que «se dio cuenta de la explotación limitada de esta vulnerabilidad» en junio de 2026, y agregó que fue descubierta durante las pruebas de seguridad internas.

La compañía también ha compartido indicadores de compromiso asociados con la actividad maliciosa, instando a los clientes a auditar «/var/log/nms/vmanage-server.log» para detectar cargas de archivos WAR sospechosos como se muestra a continuación:

11-June-2026 03:53:37,310 EDT INFO  [a66cdc5f-807d-4c23-944e-5c809a2ece6b] [server] [SdraAnyConnectFileUploadHandler] (default task-40704) |default| uploaded Remote Access Anyconnect profile file: ../../../../var/lib/wildfly/standalone/deployments/suspicious.war to vManage.
Ciberseguridad

Otros indicadores incluyen intentos de implementar código malicioso e interactuar con él, aunque Cisco advirtió que es posible que no «aparezcan consistentemente» en todos los registros de incidentes. Las actividades de seguimiento relacionadas con esta vulnerabilidad son:

CVE-2026-20262 es la octava falla de seguridad que afecta a Cisco SD-WAN y que se marca como explotada activamente solo este año después de CVE-2026-20245, CVE-2026-20182, CVE-2026-20127, CVE-2026-20122, CVE-2026-20128. CVE-2026-20133 y CVE-2022-20775. La explotación de algunas de estas fallas se ha atribuido a un actor de amenaza persistente avanzada (APT) llamado UAT-8616.

El desarrollo ha llevado a la Agencia de Seguridad de Infraestructura y Ciberseguridad de EE. UU. (CISA) a agregar la falla de sus vulnerabilidades explotadas conocidas (KEV), que exige que las agencias del Poder Ejecutivo Civil Federal (FCEB) apliquen las correcciones antes del 29 de junio de 2026.

Anthropic lanza Claude Fable 5, su IA más poderosa hasta el momento, con salvaguardias cibernéticas – CYBERDEFENSA.MX

El 9 de junio, Antrópico lanzado Claude Fábula 5el modelo más capaz que jamás haya fabricado, está disponible de forma generalizada. También hizo algo inusual: envió un modelo como dos productos, divididos no por capacidad sino por una capa de clasificadores de seguridad.

Fábula 5 sale al público. Su gemelo, Claude Mythos 5, el mismo modelo subyacente con las salvaguardas cibernéticas eliminadas, permanece restringido a un grupo examinado de ciberdefensores y operadores de infraestructura crítica.

Anthropic considera que Mythos 5 es el modelo de ciberseguridad más sólido del mundo.

La diferencia práctica es la siguiente: Fable 5 enruta las solicitudes cibernéticas, biológicas, químicas y de destilación al Claude Opus 4.8, más débil, mientras que Mythos 5 mantiene las capacidades cibernéticas disponibles para los usuarios examinados. Ambos modelos cuestan 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, menos de la mitad del precio del Mythos Preview anterior, y Fable 5 ya está disponible a través de la API de Claude.

Está incluido en los planes Pro, Max, Team y Enterprise basados ​​en asientos sin costo adicional hasta el 22 de junio y luego pasa a créditos de uso.

Cómo funcionan los clasificadores cibernéticos de Fable 5

La división existe porque los modelos de clase Mythos encuentran y explotan vulnerabilidades de software lo suficientemente bien como para que, en el marco de Anthropic, entregar esa capacidad al público en general sin controles daría a los atacantes un gran beneficio.

El mecanismo es un conjunto de clasificadores: sistemas de IA separados que vigilan el mal uso y los intentos de jailbreak. Cuando una solicitud lo hace tropezar, Fable 5 no se niega. La respuesta se entrega a Opus 4.8 y se le informa al usuario que se produjo la transferencia. De las categorías marcadas, la destilación es la que destaca: significa extraer las capacidades de un modelo para entrenar un modelo competidor, que Anthropic bloquea para evitar que las habilidades cercanas a la frontera se filtren sin salvaguardias adjuntas.

Ciberseguridad

El clasificador de ciberseguridad es el amplio. Anthropic lo diseñó para bloquear no sólo el desarrollo de exploits sino también las tareas cibernéticas ofensivas en general: reconocimiento, descubrimiento, movimiento lateral, los pasos de agencia que conforman un ataque real.

En una evaluación interna ejecutada con Fable 5 configurado para bloquear en lugar de retroceder, y que no intentó evadir las salvaguardas, los clasificadores impidieron que el modelo progresara en esas tareas. Un socio externo descubrió que Fable 5 cumplió con cero solicitudes dañinas de un solo turno sobre planificación de ataques cibernéticos, desarrollo de exploits o evasión de defensa, resistiendo 30 técnicas públicas diferentes de jailbreak.

La compensación son los falsos positivos. Anthropic ajustó las medidas de seguridad de manera conservadora para realizar envíos rápidos, por lo que a veces detectan solicitudes inofensivas. La compañía dice que el respaldo se activa en menos del 5% de todas las sesiones, por lo que durante más del 95%, Fable 5 se comporta como el Mythos 5 cibernético sin restricciones. Esa cifra cubre todos los respaldos, incluidos los bloques genuinos, por lo que limita la interrupción total en lugar de medir la tasa de falsos positivos por sí solo. Anthropic dice que reducirá las salvaguardas y eliminará los falsos positivos después del lanzamiento.

En cuanto a la solidez, las cifras son específicas. Una recompensa por errores externos duró más de 1000 horas y no produjo ningún jailbreak universal, ni un aviso ni un arnés que elimine las salvaguardias por completo. Los equipos rojos externos tampoco encontraron ninguno en tareas de agente de larga duración, con una advertencia que Anthropic afirma claramente: el Instituto de Seguridad de IA del Reino Unido avanzó hacia un jailbreak universal dentro de una breve ventana de prueba inicial. Anthropic admite que probablemente sea imposible prevenir por completo los jailbreaks universales, y su objetivo declarado es hacer que aquellos que sigan siendo lo suficientemente lentos y costosos como para detectarlos antes de que se utilicen a escala.

¿Por qué la capacidad es una amenaza?

Los argumentos a favor de tratar este modelo con cuidado se expusieron en abril, cuando Anthropic lanzó Vista previa de Claude Mythos para un grupo limitado a través de Proyecto Ala de Vidrio. El redacción técnica del equipo rojo de Anthropic es la parte que vale la pena leer.

Durante las pruebas, Mythos Preview identificó y aprovechó vulnerabilidades de día cero en todos los principales sistemas operativos y en todos los principales navegadores web cuando un usuario lo indicó. El error más antiguo que encontró fue una falla de hace 27 años en OpenBSD, un sistema operativo conocido principalmente por su seguridad. Escribió de forma autónoma un exploit de ejecución remota de código contra el servidor NFS de FreeBSD a partir de un error de hace 17 años, clasificado como CVE-2026-4747.

Anthropic describe el resultado como raíz completa para un atacante no autenticado desde cualquier lugar de Internet; La entrada de NVD es más mesurada, teniendo en cuenta que el desbordamiento de la pila en sí no requiere que el cliente se autentique, sino que encuadra la ejecución del código del kernel como accesible para un atacante capaz de enviar paquetes al servidor NFS mientras el módulo kgssapi.ko está cargado.

Según el propio Anthropic, no entrenó explícitamente estas capacidades en; surgieron como un efecto secundario de mejoras generales en el código, el razonamiento y la autonomía, las mismas ganancias que hacen que el modelo sea mejor en la aplicación de parches. La advertencia categórica del equipo rojo: las mitigaciones cuyo valor de seguridad proviene de la fricción en lugar de barreras duras se vuelven mucho más débiles frente a un modelo que avanza a través de tediosos pasos de explotación a escala.

Barreras técnicas duras como KASLR y W^X aún aumentan el costo; la advertencia es más limitada, dirigida a defensas que dependen de la paciencia del atacante o del esfuerzo manual, y el modelo ahora puede autoabastecerse.

Mythos 5 lleva adelante esas habilidades. Anthropic dice que los usuarios lo encontrarán comparable o algo más potente que Mythos Preview.

El verdadero problema del defensor

El argumento defensivo no es hipotético. En las primeras semanas del Proyecto Glasswing, Anthropic y aproximadamente 50 socios utilizaron Mythos Preview para encontrar más de diez mil vulnerabilidades de gravedad alta o crítica en software de importancia sistémica.

Solo Cloudflare encontró 2000 errores, 400 de ellos de gravedad alta o crítica. Mozilla encontró y solucionó 271 en Firefox 150, más de diez veces lo que detectó en Firefox 148 usando el antiguo Opus 4.6. Anthropic dice que la misma presión es visible más allá de Glasswing, en los proveedores que envían versiones de seguridad inusualmente grandes.

Esa inundación es el truco. Encontrar errores ahora es barato y rápido. Verificarlos, clasificarlos y parchearlos no lo es, y aún funciona en tiempo humano.

Anthropic informa que los mantenedores de código abierto, ya enterrados bajo informes de errores de baja calidad generados por IA, le han pedido que ralentice sus divulgaciones porque no pueden escribir parches lo suficientemente rápido. En Glasswing, dice que un error de gravedad alta o crítica encontrado por el modelo tarda unas dos semanas en corregirse en promedio.

El cuello de botella ha pasado del descubrimiento a la solución, y la brecha entre una divulgación pública y un parche implementado es donde viven los atacantes. Los experimentos del día N del equipo rojo agudizan el punto: partiendo de nada más que un CVE revelado y su parche, Mythos Preview creó exploits de escalada de privilegios de Linux en menos de un día cada uno, con unos pocos miles de dólares o menos en cómputo.

Ciberseguridad

Para los defensores, la lectura es la misma de siempre, solo que en un tiempo más corto: asumir que un CVE de alta gravedad puede convertirse en un exploit funcional a las pocas horas de su divulgación, no semanas. Eso significa priorizar las rutas de actualización automática para los sistemas conectados a Internet y tratar los problemas de dependencia que conllevan correcciones CVE como un trabajo urgente en lugar de un trabajo atrasado.

La MFA y el registro integral siguen siendo la base, por lo que un único parche perdido no se convierte en lo único que se interpone entre un atacante y la red. Anthropic ha abierto una Programa de verificación cibernética que permite a los profesionales de seguridad examinados utilizar sus modelos para trabajos ofensivos legítimos sin las salvaguardias cibernéticas.

Un nuevo requisito de retención de datos de 30 días

Anthropic también está cambiando la forma en que maneja los datos para los modelos de clase Mythos.

Requerirá una retención de 30 días para todo el tráfico en Fable 5, Mythos 5 y modelos futuros en este nivel de capacidad, tanto en superficies propias como de terceros. La compañía dice que no utilizará los datos para capacitación ni ningún propósito que no sea de seguridad, registrará todo acceso humano y los eliminará después de 30 días, excepto cuando una investigación de seguridad u obligación legal requiera conservarlos por más tiempo.

La razón declarada es defensiva: los datos ayudan a detectar nuevos ataques y jailbreaks que operan en muchas solicitudes. Los equipos con requisitos estrictos de manejo de datos querrán tener en cuenta esa ventana de retención antes de enrutar el tráfico confidencial a través de estos modelos.

Anthropic planea ampliar el acceso a Mythos 5 a través de un programa de acceso confiable y dice que una vez que la capacidad de cómputo se ponga al día, su objetivo es volver a incluir Fable 5 en planes de suscripción sin la prima de crédito de uso que entrará en vigor después del 22 de junio.

La pregunta más importante que plantea el lanzamiento es la que Anthropic ha estado dando vueltas desde abril: están llegando modelos con capacidades similares de otros laboratorios, y no todos se enviarán con una pared de clasificadores al frente. La ventaja defensiva que Glasswing debía comprar sólo importa si el resto de la industria la utiliza.

Microsoft lanza medidas de mitigación para el exploit YellowKey BitLocker Bypass CVE-2026-45585 – CYBERDEFENSA.MX

Microsoft lanzó el martes una mitigación para una vulnerabilidad de omisión de BitLocker llamada YellowKey luego de su divulgación pública la semana pasada.

La falla de día cero, ahora rastreada como CVE-2026-45585tiene una puntuación CVSS de 6,8. Se ha descrito como una omisión de la característica de seguridad de BitLocker.

«Microsoft es consciente de una vulnerabilidad de elusión de una característica de seguridad en Windows a la que públicamente se hace referencia como ‘YellowKey’», el gigante tecnológico dicho en un aviso. «La prueba de concepto de esta vulnerabilidad se ha hecho pública, violando las mejores prácticas coordinadas de vulnerabilidad».

El problema afecta a Windows 11 versión 26H1 para sistemas basados ​​en x64, Windows 11 versión 24H2 para sistemas basados ​​en x64, Windows 11 versión 25H2 para sistemas basados ​​en x64, Windows Server 2025 y Windows Server 2025 (instalación Server Core).

Ciberseguridad

YellowKey fue revelado por un investigador de seguridad llamado Chaotic Eclipse (también conocido como Nightmare-Eclipse). Básicamente, permite colocar archivos ‘FsTx’ especialmente diseñados en una unidad USB o partición EFI, conectar la unidad USB a la computadora Windows de destino con las protecciones BitLocker activadas, reiniciar en el Entorno de recuperación de Windows (WinRE) y activar un shell con acceso sin restricciones manteniendo presionada la tecla CTRL.

«Si hizo todo correctamente, se generará un shell con acceso ilimitado al volumen protegido de BitLocker», señaló el investigador en una publicación de GitHub.

Redmond señaló que una explotación exitosa podría permitir a un atacante con acceso físico eludir la función de cifrado de dispositivo BitLocker en el dispositivo de almacenamiento del sistema y obtener acceso a datos cifrados.

Para abordar el riesgo, se han descrito las siguientes mitigaciones:

  • Monte la imagen de WinRE en cada dispositivo.
  • Monte la sección del registro del sistema de la imagen de WinRE montada.
  • Modifique BootExecute eliminando el valor «autofstx.exe» del valor BootExecute REG_MULTI_SZ del Administrador de sesiones.
  • Guardar y descargar colmena de registro.
  • Desmonte y confirme la imagen WinRE actualizada.
  • Restablezca la confianza de BitLocker para WinRE.

«Específicamente, evita que la utilidad de recuperación automática FsTx, autofstx.exe, se inicie automáticamente cuando se inicia la imagen de WinRE», dijo el investigador de seguridad Will Dormann. dicho. «Con este cambio, la reproducción NTFS transaccional que elimina winpeshl.ini ya no ocurre. También recomienda cambiar de solo TPM a TPM+PIN».

Ciberseguridad

Microsoft también enfatizó que los usuarios pueden estar protegidos contra la explotación mediante configurando BitLocker en dispositivos ya cifrados con protector «solo TPM» cambiando al modo «TPM+PIN» a través de PowerShell, la línea de comando o el panel de control. Esto requerirá un PIN para descifrar la unidad al inicio, respaldando efectivamente los ataques de YellowKey.

En dispositivos que no están cifrados, se recomienda a los administradores habilitar la opción «Requerir autenticación adicional al inicio» a través de Microsoft Intune o Políticas de grupo y asegurarse de que «Configurar PIN de inicio de TPM» esté configurado en «Requerir PIN de inicio con TPM».

OpenAI lanza Daybreak para la detección de vulnerabilidades y validación de parches impulsada por IA – CYBERDEFENSA.MX

OpenAI ha lanzado Recreo de díauna nueva iniciativa de ciberseguridad que reúne capacidades de modelos de inteligencia artificial (IA) de vanguardia y Codex Security para ayudar a las organizaciones a identificar y parchear vulnerabilidades antes de que los atacantes encuentren una manera de utilizar los mismos problemas.

«Daybreak combina la inteligencia de los modelos OpenAI, la extensibilidad de Codex como un arnés de agencia y nuestros socios en todo el volante de seguridad para ayudar a hacer el mundo más seguro para todos», dijo la empresa emergente de IA. dicho. «Los defensores pueden incorporar revisión de código seguro, modelado de amenazas, validación de parches, análisis de riesgos de dependencia, detección y orientación de corrección al ciclo de desarrollo diario para que el software se vuelva más resistente desde el principio».

Al igual que Mythos de Anthropic, la idea es aprovechar la IA para inclinar la balanza a favor de los defensores y ayudar a detectar y abordar problemas de seguridad antes de que los malos actores los encuentren. El acceso a las herramientas sigue estando estrictamente controlado por ahora, y OpenAI insta a las organizaciones interesadas a solicitar un análisis de vulnerabilidades o ponerse en contacto con su equipo de ventas.

Ciberseguridad

Daybreak aprovecha Codex Security para crear un modelo de amenazas editable para un repositorio determinado que se centra en rutas de ataque realistas y código de alto impacto, identifica y prueba vulnerabilidades en un entorno aislado y propone soluciones.

El esfuerzo se basa en tres modelos: GPT-5.5 (que tiene protecciones estándar para uso general), GPT-5.5 con Trusted Access for Cyber ​​(para trabajo defensivo verificado en entornos autorizados) y GPT-5.5-Cyber ​​(un modelo permisivo para equipos rojos, pruebas de penetración y validación controlada).

Varias empresas importantes como Akamai, Cisco, Cloudflare, CrowdStrike, Fortinet, Oracle, Palo Alto Networks y Zscaler ya están integrando estas capacidades bajo la iniciativa Trusted Access for Cyber, dijo OpenAI, agregando que está trabajando con socios de la industria y el gobierno para implementar «más modelos con capacidad cibernética» en el futuro.

El lanzamiento se produce cuando las herramientas de inteligencia artificial han acortado el tiempo necesario para descubrir problemas de seguridad latentes que de otro modo podrían haber pasado desapercibidos, convirtiendo lo que antes habría requerido una cantidad significativa de tiempo y esfuerzo en un período de trabajo mucho más corto. Como resultado, el proceso de parcheo puede tener dificultades para mantenerse incluso en condiciones ideales.

A principios de marzo, HackerOne pausado su programa de recompensas por errores cita un cambio en el equilibrio entre los descubrimientos de vulnerabilidades y la capacidad de los mantenedores de código abierto para abordarlos, atribuyéndolo a cómo la investigación asistida por IA ha llevado a un aumento en el volumen de nuevas fallas y la velocidad a la que se identifican.

Esto también ha tenido el efecto secundario de lo que se llama fatiga de clasificación, donde los mantenedores del proyecto deben examinar una avalancha de informes de vulnerabilidad, algunos de los cuales podrían parecer plausibles pero completamente alucinados por los modelos de IA.

Ciberseguridad

A medida que la IA reduce la barrera para encontrar fallas de seguridad, empresas como Anthropic, Google y OpenAI han posicionado cada vez más a los agentes de seguridad de IA como una nueva capa operativa para abordar el cuello de botella de remediación y salvaguardar la infraestructura digital de una posible explotación.

En una publicación publicada la semana pasada, el investigador de seguridad Himanshu Anand dicho «La política de divulgación de 90 días está muerta», ya que los grandes modelos de lenguaje (LLM) comprimen la divulgación y explotan los plazos hasta casi cero.

«Cuando 10 investigadores no relacionados encuentran el mismo error en seis semanas, y la IA puede convertir un parche en un exploit funcional en 30 minutos, ¿qué protege exactamente la ventana de 90 días? Nadie», dijo Anand.

Google bloquea 8.300 millones de anuncios que infringen políticas en 2025 y lanza una revisión de privacidad de Android 17 – CYBERDEFENSA.MX

Google esta semana anunciado un nuevo conjunto de actualizaciones de la política de Play para fortalecer la privacidad del usuario y proteger a las empresas contra el fraude, incluso cuando reveló que bloqueó o eliminó más de 8,3 mil millones de anuncios en todo el mundo y suspendió 24,9 millones de cuentas en 2025.

Las nuevas actualizaciones de políticas se relacionan con los permisos de contacto y ubicación en Android, lo que permite que aplicaciones de terceros accedan a las listas de contactos y a la ubicación de un usuario de una manera más respetuosa con la privacidad. Esto incluye un nuevo Selector de contactos, que ofrece una interfaz estandarizada, segura y con capacidad de búsqueda para la selección de contactos.

«Esta característica permite a los usuarios otorgar acceso a las aplicaciones sólo a los contactos específicos que elijan, alineándose con el compromiso de Android con la transparencia de los datos y la minimización de los permisos», dijo Google. dicho.

Anteriormente, las aplicaciones que requerían acceso a los contactos de un usuario específico dependían de READ_CONTACTS, un permiso demasiado amplio que otorgaba a las aplicaciones la capacidad de acceder a todos los contactos y su información asociada. Con el último cambio introducido en Android 17, las aplicaciones pueden especificar qué campos de un contacto necesitan, como números de teléfono o direcciones de correo electrónico, en lugar de leer el registro completo.

Ciberseguridad

La política actualizada requerirá que todas las aplicaciones aplicables utilicen el selector (o el Hoja compartida de Android) como la forma principal de acceder a los contactos de los usuarios, con READ_CONTACTS ahora reservado solo para aplicaciones que no pueden funcionar sin él. Se recomienda eliminar por completo el permiso READ_CONTACTS de la declaración del manifiesto de la aplicación si está dirigida a las versiones 17 de Android (actualmente en versión beta) y posteriores.

«Si su aplicación requiere acceso completo y continuo a la lista de contactos de un usuario para funcionar, debe justificar esta necesidad enviando una Declaración de desarrollador de Play en Play Console», señaló Google.

El segundo cambio de política gira en torno a una botón de ubicación optimizado que Google ha introducido en Android 17 que permite que las aplicaciones soliciten acceso único a la ubicación precisa de un usuario. Al hacerlo, permite al usuario elegir mejor cuánta información desea compartir y durante cuánto tiempo. Es más, aparecerá un indicador persistente para alertar al usuario cada vez que una aplicación ajena al sistema acceda a su ubicación.

Para cumplir con esta actualización, se insta a los desarrolladores a revisar el uso de la ubicación de sus aplicaciones para asegurarse de que solicitan la cantidad mínima de datos de ubicación necesarios para que funcionen.

«Si su aplicación está dirigida a Android 17 y superior y utiliza una ubicación precisa para acciones temporales discretas, implemente el botón de ubicación agregando la bandera onlyForLocationButton en su manifiesto», dijo el gigante tecnológico. «Si su aplicación requiere una ubicación persistente y precisa para funcionar, deberá enviar una Declaración de desarrollador de Play en Play Console para mostrar por qué el nuevo botón o la ubicación aproximada no es suficiente para las funciones principales de su aplicación».

Se espera que el formulario de declaración esté disponible antes de octubre de 2026, con comprobaciones previas a la revisión en Play Console que estarán disponibles a partir del 27 de octubre para identificar posibles contactos o problemas con la política de permisos de ubicación.

Google también está implementando una forma segura para que las empresas transfieran la propiedad de sus aplicaciones a través de una función de transferencia de cuenta nativa integrada en Play Console para mantenerse protegidas contra el fraude. La compañía recomienda que los desarrolladores de aplicaciones gestionen los cambios de propiedad de la cuenta a través de esta función a partir del 27 de mayo de 2026.

«Eso significa que no se permiten transferencias no oficiales (como compartir credenciales de inicio de sesión o comprar y vender cuentas en mercados de terceros), que dejan a su negocio vulnerable», dijo.

Google apunta a la publicidad maliciosa

Los cambios en el ecosistema Android llegan según Google dicho está aprovechando las capacidades de Gemini, su modelo de inteligencia artificial (IA), para detectar y bloquear anuncios maliciosos en su plataforma. Más del 99% de los anuncios que infringen las políticas fueron detectados por sus sistemas en 2025 antes de mostrarse a los usuarios, señaló.

Ciberseguridad

«A diferencia de los sistemas anteriores basados ​​en palabras clave, nuestros últimos modelos comprenden mejor la intención, ayudándonos a detectar contenido malicioso y bloquearlo preventivamente, incluso cuando está diseñado para evadir la detección», dijo Keerat Sharma, vicepresidente y director general de Privacidad y Seguridad de Anuncios de Google, en una publicación compartida con The Hacker News.

En conjunto, la compañía eliminó o bloqueó 602 millones de anuncios y 4 millones de cuentas asociadas con estafas o actividades relacionadas con estafas el año pasado. Se restringieron más de 4.800 millones de anuncios y se tomaron medidas contra más de 480 millones de páginas web por intentar ofrecer contenido sexual explícito, promoción de armas, juegos de azar en línea, alcohol, tabaco y malware.

Por el contrario, Google suspendió más de 39,2 millones de cuentas de anunciantes en 2024, detuvo 5,1 mil millones de anuncios malos, restringió 9,1 mil millones de anuncios y bloqueó o restringió anuncios en 1,3 mil millones de páginas.

«Los malos actores están utilizando IA generativa para crear anuncios engañosos a escala, y Gemini nos ayuda a detectarlos y bloquearlos en tiempo real», dijo Google. «A finales del año pasado, la mayoría de los anuncios de búsqueda adaptables creados en Google Ads se revisaron instantáneamente y el contenido dañino se bloqueó en el momento del envío, una capacidad que planeamos implementar en más formatos de anuncios este año».

OpenAI lanza GPT-5.4-Cyber ​​con acceso ampliado para equipos de seguridad – CYBERDEFENSA.MX

OpenAI presentado el martes GPT-5.4-Cibernéticouna variante de su último modelo estrella, GPT‑5.4que está optimizado específicamente para casos de uso de ciberseguridad defensiva, días después de que su rival Anthropic presentara su propio modelo de frontera, Mythos.

«El uso progresivo de la IA acelera a los defensores (los responsables de mantener seguros los sistemas, los datos y los usuarios) permitiéndoles encontrar y solucionar problemas más rápidamente en la infraestructura digital en la que todos confían», OpenAI dicho.

Junto con el anuncio, la compañía de inteligencia artificial (IA) dijo que está aumentando su acceso confiable para cibernética (TAC) programa a miles de defensores individuales autenticados y cientos de equipos responsables de proteger el software crítico.

Los sistemas de IA son inherentemente de doble uso, ya que los malos actores pueden reutilizar las tecnologías desarrolladas para aplicaciones legítimas en su propio beneficio y lograr objetivos maliciosos. Un área central de preocupación es que los adversarios podrían invertir los modelos ajustados para la defensa del software para detectar y explotar vulnerabilidades en software ampliamente utilizado antes de que puedan ser parcheados, exponiendo a los usuarios a riesgos significativos.

OpenAI dijo que el objetivo es democratizar el acceso a sus modelos y al mismo tiempo minimizar dicho uso indebido, así como fortalecer sus salvaguardias mediante una implementación deliberada e iterativa. La idea es permitir un uso responsable a escala, dar a los defensores una ventaja y, al mismo tiempo, reforzar las barreras contra las fugas y las inyecciones rápidas de los adversarios a medida que las capacidades del modelo se vuelven más avanzadas.

Ciberseguridad

«A medida que avanzan las capacidades del modelo, nuestro enfoque es escalar la ciberdefensa al mismo tiempo: ampliar el acceso para los defensores legítimos mientras continuamos fortaleciendo las salvaguardas», agregó la compañía.

El fabricante de ChatGPT, que lanzó Codex Security como una forma de encontrar, validar y proponer soluciones para vulnerabilidades, reveló que el agente de seguridad de aplicaciones impulsado por IA ha contribuido a más de 3000 vulnerabilidades críticas y altamente reparadas.

El lanzamiento limitado de OpenAI sigue a la vista previa de Mythos de Anthropic, un modelo de frontera que se está implementando de manera controlada como parte del Proyecto. ala de cristal. El modelo, dijo la compañía, encontró «miles» de vulnerabilidades en sistemas operativos, navegadores web y otro software.

«El ecosistema más fuerte es aquel que identifica, valida y soluciona continuamente problemas de seguridad a medida que se escribe el software», dijo OpenAI. «Al integrar modelos de codificación avanzados y capacidades de agencia en los flujos de trabajo de los desarrolladores, podemos brindarles comentarios inmediatos y prácticos mientras construyen, cambiando la seguridad de auditorías episódicas e inventarios de errores estáticos a una reducción de riesgos continua y tangible».