{"id":1145,"date":"2026-06-10T09:19:13","date_gmt":"2026-06-10T09:19:13","guid":{"rendered":"https:\/\/cybercolombia.co\/index.php\/2026\/06\/10\/anthropic-lanza-claude-fable-5-su-ia-mas-poderosa-hasta-el-momento-con-salvaguardias-ciberneticas-cyberdefensa-mx\/"},"modified":"2026-06-10T09:19:13","modified_gmt":"2026-06-10T09:19:13","slug":"anthropic-lanza-claude-fable-5-su-ia-mas-poderosa-hasta-el-momento-con-salvaguardias-ciberneticas-cyberdefensa-mx","status":"publish","type":"post","link":"https:\/\/cybercolombia.co\/index.php\/2026\/06\/10\/anthropic-lanza-claude-fable-5-su-ia-mas-poderosa-hasta-el-momento-con-salvaguardias-ciberneticas-cyberdefensa-mx\/","title":{"rendered":"Anthropic lanza Claude Fable 5, su IA m\u00e1s poderosa hasta el momento, con salvaguardias cibern\u00e9ticas \u2013 CYBERDEFENSA.MX"},"content":{"rendered":"<div id=\"articlebody\">\n<p>El 9 de junio, Antr\u00f3pico <a href=\"https:\/\/www.anthropic.com\/news\/claude-fable-5-mythos-5\">lanzado Claude F\u00e1bula 5<\/a>el modelo m\u00e1s capaz que jam\u00e1s haya fabricado, est\u00e1 disponible de forma generalizada. Tambi\u00e9n hizo algo inusual: envi\u00f3 un modelo como dos productos, divididos no por capacidad sino por una capa de clasificadores de seguridad.<\/p>\n<p>F\u00e1bula 5 sale al p\u00fablico. Su gemelo, Claude Mythos 5, el mismo modelo subyacente con las salvaguardas cibern\u00e9ticas eliminadas, permanece restringido a un grupo examinado de ciberdefensores y operadores de infraestructura cr\u00edtica.<\/p>\n<p>Anthropic considera que Mythos 5 es el modelo de ciberseguridad m\u00e1s s\u00f3lido del mundo.<\/p>\n<p>La diferencia pr\u00e1ctica es la siguiente: Fable 5 enruta las solicitudes cibern\u00e9ticas, biol\u00f3gicas, qu\u00edmicas y de destilaci\u00f3n al Claude Opus 4.8, m\u00e1s d\u00e9bil, mientras que Mythos 5 mantiene las capacidades cibern\u00e9ticas disponibles para los usuarios examinados. Ambos modelos cuestan 10 d\u00f3lares por mill\u00f3n de tokens de entrada y 50 d\u00f3lares por mill\u00f3n de tokens de salida, menos de la mitad del precio del Mythos Preview anterior, y Fable 5 ya est\u00e1 disponible a trav\u00e9s de la API de Claude.<\/p>\n<p>Est\u00e1 incluido en los planes Pro, Max, Team y Enterprise basados \u200b\u200ben asientos sin costo adicional hasta el 22 de junio y luego pasa a cr\u00e9ditos de uso.<\/p>\n<h2>C\u00f3mo funcionan los clasificadores cibern\u00e9ticos de Fable 5<\/h2>\n<p>La divisi\u00f3n existe porque los modelos de clase Mythos encuentran y explotan vulnerabilidades de software lo suficientemente bien como para que, en el marco de Anthropic, entregar esa capacidad al p\u00fablico en general sin controles dar\u00eda a los atacantes un gran beneficio.<\/p>\n<p>El mecanismo es un conjunto de <a href=\"https:\/\/www.anthropic.com\/news\/claude-fable-5-mythos-5\">clasificadores<\/a>: sistemas de IA separados que vigilan el mal uso y los intentos de jailbreak. Cuando una solicitud lo hace tropezar, Fable 5 no se niega. La respuesta se entrega a Opus 4.8 y se le informa al usuario que se produjo la transferencia. De las categor\u00edas marcadas, la destilaci\u00f3n es la que destaca: significa extraer las capacidades de un modelo para entrenar un modelo competidor, que Anthropic bloquea para evitar que las habilidades cercanas a la frontera se filtren sin salvaguardias adjuntas.<\/p>\n<div class=\"dog_two clear\">\n<div class=\"cf\"><a href=\"https:\/\/thehackernews.uk\/ai-cant-stop-d\" rel=\"nofollow noopener sponsored\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"lazyload\" alt=\"Ciberseguridad\" src=\"https:\/\/blogger.googleusercontent.com\/img\/b\/R29vZ2xl\/AVvXsEjPEV6-530TOlxG6PjrmdlY623wpBwduZ7t1HV6flcmO5R4q4AmfixDUzW0CrhlvMVNWbhvOIso-UDNTka4W_W9Chrdj_dglwBZwi7DuePM2IMIl-hfUYVIqBXgfpr_2619K8Gptb4LzwJ6gUbi7lWl2M8AFQJsHEaw63Q7tZ6708YGruiHrr0Y2W9YYxLQ\/s728-e100\/ThreatLocker-d.png\" width=\"729\" height=\"91\"\/><\/a><\/div>\n<\/div>\n<p>El clasificador de ciberseguridad es el amplio. Anthropic lo dise\u00f1\u00f3 para bloquear no s\u00f3lo el desarrollo de exploits sino tambi\u00e9n las tareas cibern\u00e9ticas ofensivas en general: reconocimiento, descubrimiento, movimiento lateral, los pasos de agencia que conforman un ataque real.<\/p>\n<p>En una evaluaci\u00f3n interna ejecutada con Fable 5 configurado para bloquear en lugar de retroceder, y que no intent\u00f3 evadir las salvaguardas, los clasificadores impidieron que el modelo progresara en esas tareas. Un socio externo descubri\u00f3 que Fable 5 cumpli\u00f3 con cero solicitudes da\u00f1inas de un solo turno sobre planificaci\u00f3n de ataques cibern\u00e9ticos, desarrollo de exploits o evasi\u00f3n de defensa, resistiendo 30 t\u00e9cnicas p\u00fablicas diferentes de jailbreak.<\/p>\n<p>La compensaci\u00f3n son los falsos positivos. Anthropic ajust\u00f3 las medidas de seguridad de manera conservadora para realizar env\u00edos r\u00e1pidos, por lo que a veces detectan solicitudes inofensivas. La compa\u00f1\u00eda dice que el respaldo se activa en menos del 5% de todas las sesiones, por lo que durante m\u00e1s del 95%, Fable 5 se comporta como el Mythos 5 cibern\u00e9tico sin restricciones. Esa cifra cubre todos los respaldos, incluidos los bloques genuinos, por lo que limita la interrupci\u00f3n total en lugar de medir la tasa de falsos positivos por s\u00ed solo. Anthropic dice que reducir\u00e1 las salvaguardas y eliminar\u00e1 los falsos positivos despu\u00e9s del lanzamiento.<\/p>\n<p>En cuanto a la solidez, las cifras son espec\u00edficas. Una recompensa por errores externos dur\u00f3 m\u00e1s de 1000 horas y no produjo ning\u00fan jailbreak universal, ni un aviso ni un arn\u00e9s que elimine las salvaguardias por completo. Los equipos rojos externos tampoco encontraron ninguno en tareas de agente de larga duraci\u00f3n, con una advertencia que Anthropic afirma claramente: el Instituto de Seguridad de IA del Reino Unido avanz\u00f3 hacia un jailbreak universal dentro de una breve ventana de prueba inicial. Anthropic admite que probablemente sea imposible prevenir por completo los jailbreaks universales, y su objetivo declarado es hacer que aquellos que sigan siendo lo suficientemente lentos y costosos como para detectarlos antes de que se utilicen a escala.<\/p>\n<h2>\u00bfPor qu\u00e9 la capacidad es una amenaza?<\/h2>\n<p>Los argumentos a favor de tratar este modelo con cuidado se expusieron en abril, cuando Anthropic lanz\u00f3 <a href=\"https:\/\/thehackernews.com\/2026\/04\/anthropics-claude-mythos-finds.html\">Vista previa de Claude Mythos para un grupo limitado a trav\u00e9s de <\/a><a href=\"https:\/\/www.anthropic.com\/glasswing\">Proyecto Ala de Vidrio<\/a>. El <a href=\"https:\/\/red.anthropic.com\/2026\/mythos-preview\/\">redacci\u00f3n t\u00e9cnica<\/a> del equipo rojo de Anthropic es la parte que vale la pena leer.<\/p>\n<p>Durante las pruebas, Mythos Preview identific\u00f3 y aprovech\u00f3 vulnerabilidades de d\u00eda cero en todos los principales sistemas operativos y en todos los principales navegadores web cuando un usuario lo indic\u00f3. El error m\u00e1s antiguo que encontr\u00f3 fue una falla de hace 27 a\u00f1os en OpenBSD, un sistema operativo conocido principalmente por su seguridad. Escribi\u00f3 de forma aut\u00f3noma un exploit de ejecuci\u00f3n remota de c\u00f3digo contra el servidor NFS de FreeBSD a partir de un error de hace 17 a\u00f1os, clasificado como <a href=\"https:\/\/nvd.nist.gov\/vuln\/detail\/CVE-2026-4747\">CVE-2026-4747<\/a>.<\/p>\n<div class=\"separator\" style=\"clear: both;\"><a href=\"https:\/\/blogger.googleusercontent.com\/img\/b\/R29vZ2xl\/AVvXsEjm17e8YGTWGgpjdyeWagAhzy6Y7dIdnJ58odo2d3vBStsufqfxA22IaXax4hhDSeoiMC2TUhoe2Ikmd8uUDkj1MkrFDW8_EM4o2gjskxWdMNZJtPMu2N6stnSS6J-fQnoy4cPcT2kqHOT2-TqNRm7Yfv8YK9OS8JXCV1U9xrEOooTubbQoaeXz8e2NSpw\/s1700-e365\/claude.jpg\" style=\"display: block;  text-align: center; clear: left; float: left;\"><img decoding=\"async\" src=\"https:\/\/blogger.googleusercontent.com\/img\/b\/R29vZ2xl\/AVvXsEjm17e8YGTWGgpjdyeWagAhzy6Y7dIdnJ58odo2d3vBStsufqfxA22IaXax4hhDSeoiMC2TUhoe2Ikmd8uUDkj1MkrFDW8_EM4o2gjskxWdMNZJtPMu2N6stnSS6J-fQnoy4cPcT2kqHOT2-TqNRm7Yfv8YK9OS8JXCV1U9xrEOooTubbQoaeXz8e2NSpw\/s1700-e365\/claude.jpg\" alt=\"\" border=\"0\" data-original-height=\"2870\" data-original-width=\"2600\"\/><\/a><\/div>\n<p>Anthropic describe el resultado como ra\u00edz completa para un atacante no autenticado desde cualquier lugar de Internet; La entrada de NVD es m\u00e1s mesurada, teniendo en cuenta que el desbordamiento de la pila en s\u00ed no requiere que el cliente se autentique, sino que encuadra la ejecuci\u00f3n del c\u00f3digo del kernel como accesible para un atacante capaz de enviar paquetes al servidor NFS mientras el m\u00f3dulo kgssapi.ko est\u00e1 cargado.<\/p>\n<p>Seg\u00fan el propio Anthropic, no entren\u00f3 expl\u00edcitamente estas capacidades en; surgieron como un efecto secundario de mejoras generales en el c\u00f3digo, el razonamiento y la autonom\u00eda, las mismas ganancias que hacen que el modelo sea mejor en la aplicaci\u00f3n de parches. La advertencia categ\u00f3rica del equipo rojo: las mitigaciones cuyo valor de seguridad proviene de la fricci\u00f3n en lugar de barreras duras se vuelven mucho m\u00e1s d\u00e9biles frente a un modelo que avanza a trav\u00e9s de tediosos pasos de explotaci\u00f3n a escala.<\/p>\n<p>Barreras t\u00e9cnicas duras como KASLR y W^X a\u00fan aumentan el costo; la advertencia es m\u00e1s limitada, dirigida a defensas que dependen de la paciencia del atacante o del esfuerzo manual, y el modelo ahora puede autoabastecerse.<\/p>\n<p>Mythos 5 lleva adelante esas habilidades. Anthropic dice que los usuarios lo encontrar\u00e1n comparable o algo m\u00e1s potente que Mythos Preview.<\/p>\n<h2>El verdadero problema del defensor<\/h2>\n<p>El argumento defensivo no es hipot\u00e9tico. En las primeras semanas del Proyecto Glasswing, Anthropic y aproximadamente 50 socios utilizaron Mythos Preview para encontrar m\u00e1s de diez mil vulnerabilidades de gravedad alta o cr\u00edtica en software de importancia sist\u00e9mica.<\/p>\n<p>Solo Cloudflare encontr\u00f3 2000 errores, 400 de ellos de gravedad alta o cr\u00edtica. Mozilla encontr\u00f3 y solucion\u00f3 271 en Firefox 150, m\u00e1s de diez veces lo que detect\u00f3 en Firefox 148 usando el antiguo Opus 4.6. Anthropic dice que la misma presi\u00f3n es visible m\u00e1s all\u00e1 de Glasswing, en los proveedores que env\u00edan versiones de seguridad inusualmente grandes.<\/p>\n<p>Esa inundaci\u00f3n es el truco. Encontrar errores ahora es barato y r\u00e1pido. Verificarlos, clasificarlos y parchearlos no lo es, y a\u00fan funciona en tiempo humano.<\/p>\n<p>Anthropic informa que los mantenedores de c\u00f3digo abierto, ya enterrados bajo informes de errores de baja calidad generados por IA, le han pedido que ralentice sus divulgaciones porque no pueden escribir parches lo suficientemente r\u00e1pido. En Glasswing, dice que un error de gravedad alta o cr\u00edtica encontrado por el modelo tarda unas dos semanas en corregirse en promedio.<\/p>\n<p>El cuello de botella ha pasado del descubrimiento a la soluci\u00f3n, y la brecha entre una divulgaci\u00f3n p\u00fablica y un parche implementado es donde viven los atacantes. Los experimentos del d\u00eda N del equipo rojo agudizan el punto: partiendo de nada m\u00e1s que un CVE revelado y su parche, Mythos Preview cre\u00f3 exploits de escalada de privilegios de Linux en menos de un d\u00eda cada uno, con unos pocos miles de d\u00f3lares o menos en c\u00f3mputo.<\/p>\n<div class=\"dog_two clear\">\n<div class=\"cf\"><a href=\"https:\/\/thehackernews.uk\/vpn-threat-report-m\" rel=\"nofollow noopener sponsored\" target=\"_blank\"><img loading=\"lazy\" decoding=\"async\" class=\"lazyload\" alt=\"Ciberseguridad\" src=\"https:\/\/blogger.googleusercontent.com\/img\/b\/R29vZ2xl\/AVvXsEhFlTC7RrRZGiFAgASS0noWSL0qsQGFVp8-Hvuw9yp3X3VKRuTcb5SsPX09wJzrdIM6pu1_5lS4EeZp7Sx4iYBpNJkrGnpr08yyaS1HQ5_5TxaCsP6O0OtHNuOkesn6CbNjao1GPulCJk-uljYMSfMZfBYNrngpe669t7jlRn1FqiEnXhsFD1WVkpaYIVgh\/s728-e100\/ai-d.jpg\" width=\"729\" height=\"91\"\/><\/a><\/div>\n<\/div>\n<p>Para los defensores, la lectura es la misma de siempre, solo que en un tiempo m\u00e1s corto: asumir que un CVE de alta gravedad puede convertirse en un exploit funcional a las pocas horas de su divulgaci\u00f3n, no semanas. Eso significa priorizar las rutas de actualizaci\u00f3n autom\u00e1tica para los sistemas conectados a Internet y tratar los problemas de dependencia que conllevan correcciones CVE como un trabajo urgente en lugar de un trabajo atrasado.<\/p>\n<p>La MFA y el registro integral siguen siendo la base, por lo que un \u00fanico parche perdido no se convierte en lo \u00fanico que se interpone entre un atacante y la red. Anthropic ha abierto una <a href=\"https:\/\/support.claude.com\/en\/articles\/14604842-real-time-cyber-safeguards-on-claude\">Programa de verificaci\u00f3n cibern\u00e9tica<\/a> que permite a los profesionales de seguridad examinados utilizar sus modelos para trabajos ofensivos leg\u00edtimos sin las salvaguardias cibern\u00e9ticas.<\/p>\n<h2>Un nuevo requisito de retenci\u00f3n de datos de 30 d\u00edas<\/h2>\n<p>Anthropic tambi\u00e9n est\u00e1 cambiando la forma en que maneja los datos para los modelos de clase Mythos.<\/p>\n<p>Requerir\u00e1 una retenci\u00f3n de 30 d\u00edas para todo el tr\u00e1fico en Fable 5, Mythos 5 y modelos futuros en este nivel de capacidad, tanto en superficies propias como de terceros. La compa\u00f1\u00eda dice que no utilizar\u00e1 los datos para capacitaci\u00f3n ni ning\u00fan prop\u00f3sito que no sea de seguridad, registrar\u00e1 todo acceso humano y los eliminar\u00e1 despu\u00e9s de 30 d\u00edas, excepto cuando una investigaci\u00f3n de seguridad u obligaci\u00f3n legal requiera conservarlos por m\u00e1s tiempo.<\/p>\n<p>La raz\u00f3n declarada es defensiva: los datos ayudan a detectar nuevos ataques y jailbreaks que operan en muchas solicitudes. Los equipos con requisitos estrictos de manejo de datos querr\u00e1n tener en cuenta esa ventana de retenci\u00f3n antes de enrutar el tr\u00e1fico confidencial a trav\u00e9s de estos modelos.<\/p>\n<p>Anthropic planea ampliar el acceso a Mythos 5 a trav\u00e9s de un programa de acceso confiable y dice que una vez que la capacidad de c\u00f3mputo se ponga al d\u00eda, su objetivo es volver a incluir Fable 5 en planes de suscripci\u00f3n sin la prima de cr\u00e9dito de uso que entrar\u00e1 en vigor despu\u00e9s del 22 de junio.<\/p>\n<p>La pregunta m\u00e1s importante que plantea el lanzamiento es la que Anthropic ha estado dando vueltas desde abril: est\u00e1n llegando modelos con capacidades similares de otros laboratorios, y no todos se enviar\u00e1n con una pared de clasificadores al frente. La ventaja defensiva que Glasswing deb\u00eda comprar s\u00f3lo importa si el resto de la industria la utiliza.<\/p>\n<\/div>\n","protected":false},"excerpt":{"rendered":"<p>El 9 de junio, Antr\u00f3pico lanzado Claude F\u00e1bula 5el modelo m\u00e1s capaz que jam\u00e1s haya fabricado, est\u00e1 disponible de forma generalizada. Tambi\u00e9n hizo algo inusual: envi\u00f3 un modelo como dos productos, divididos no por capacidad sino por una capa de clasificadores de seguridad. F\u00e1bula 5 sale al p\u00fablico. Su gemelo, Claude Mythos 5, el mismo [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":752,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[25,5],"tags":[156,188,16,31,24,3019,513,164,98,3021,3020,3022],"class_list":["post-1145","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-noticias","category-trending","tag-anthropic","tag-ciberneticas","tag-claude","tag-con","tag-cyberdefensa-mx","tag-fable","tag-hasta","tag-lanza","tag-mas","tag-momento","tag-poderosa","tag-salvaguardias"],"_links":{"self":[{"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/posts\/1145","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/comments?post=1145"}],"version-history":[{"count":0,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/posts\/1145\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/media\/752"}],"wp:attachment":[{"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/media?parent=1145"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/categories?post=1145"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/cybercolombia.co\/index.php\/wp-json\/wp\/v2\/tags?post=1145"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}