- A raíz de una orden de control de exportaciones emitida por el gobierno de EE. UU. con base en facultades de seguridad nacional, se bloquea el acceso a Fable 5 y Mythos 5 para todos los ciudadanos extranjeros, dentro y fuera de Estados Unidos, y el servicio para todos los clientes se suspende de inmediato para cumplir con la normativa
- La orden se recibió a las 5:21 p. m. ET y no especifica el contenido concreto de las preocupaciones de seguridad nacional
- Se entiende que la base de la preocupación del gobierno es el conocimiento de una técnica de jailbreaking de Fable 5, pero la vulnerabilidad identificada por esa técnica ya era conocida y de nivel menor, y también puede encontrarse en otros modelos públicos sin necesidad de evasión
- Anthropic afirma que, antes del lanzamiento, realizó miles de horas de pruebas de red teaming con el gobierno de EE. UU., UK AISI y entidades externas, y que ningún evaluador encontró un jailbreak universal
- La empresa no está de acuerdo con que la posibilidad de un jailbreak de alcance limitado sea motivo para retirar un modelo comercial usado por cientos de millones de personas, y considera que si se aplicara el mismo criterio a otros proveedores de modelos, el despliegue de nuevos modelos quedaría prácticamente detenido
Contenido de la orden e impacto inmediato
- El gobierno de EE. UU. emitió una orden de control de exportaciones invocando facultades de seguridad nacional, con lo que suspende el acceso a Fable 5 y Mythos 5 para todos los ciudadanos extranjeros (incluidos empleados de Anthropic con nacionalidad extranjera), tanto dentro como fuera de Estados Unidos
- Como resultado de la orden, Anthropic desactivó repentinamente Fable 5 y Mythos 5 para todos los clientes a fin de cumplir con la normativa
- El acceso a todos los demás modelos de Anthropic no se ve afectado
- La orden se recibió ese mismo día a las 5:21 p. m. ET, y la carta no incluía detalles concretos sobre las preocupaciones de seguridad nacional
Base estimada de la preocupación del gobierno
- Se entiende que el gobierno tuvo conocimiento de una técnica de evasión o jailbreaking de Fable 5
- Tras revisar la demostración de esa técnica, Anthropic concluye que se utilizó para identificar un pequeño número de vulnerabilidades menores ya conocidas
- Estas vulnerabilidades son relativamente simples, y también pueden encontrarse de la misma forma en otros modelos públicos sin necesidad de evasión
Postura de Anthropic sobre las protecciones de Fable
- La empresa señala que implementó fuertes protecciones para reducir de manera importante el posible uso indebido en tareas como ciberseguridad, al punto de que muchos usuarios se han quejado de que son demasiado amplias
- Durante varias semanas antes del lanzamiento, llevó a cabo un total de miles de horas de validación de red teaming junto con el gobierno de EE. UU., UK AISI, múltiples terceros privados y equipos internos
- En esas pruebas, según Anthropic, se confirmó que las protecciones de Fable son materialmente más efectivas que las de cualquier otro modelo ya desplegado
- Ningún evaluador encontró un jailbreak universal (una forma de eludir ampliamente las protecciones del modelo y habilitar diversas capacidades cibernéticas)
Límites de una defensa total contra jailbreaks
- Actualmente, Anthropic considera que ningún proveedor puede lograr una resistencia completa a los jailbreaks, y que todas las protecciones de seguridad de la industria son vulnerables a jailbreaks no universales (inducción de cierta información cibernética en situaciones específicas)
- También es posible que eventualmente se descubra un jailbreak universal, algo que la empresa indicó claramente al lanzar Fable 5
Estrategia de Defense in Depth
- Ante la imposibilidad de una defensa total, Anthropic adopta una estrategia de defense in depth para limitar los jailbreaks a un alcance estrecho (no universal) o hacerlos muy costosos (universal), y detectar y bloquear rápidamente los ataques mediante monitoreo exhaustivo
- Para ello, exigió a Fable una retención de datos de clientes por 30 días, lo que implica un costo real para los clientes, pero permite investigar y mitigar jailbreaks
- La empresa mantiene esta estrategia de defensa en profundidad y sostiene que ya reduce el riesgo a un nivel comparable al de modelos existentes desplegados en toda la industria
- No ha recibido divulgaciones de jailbreaks no universales preocupantes que hayan derivado en resultados dañinos, y los posibles jailbreaks revelados hasta ahora solo produjeron respuestas inofensivas o hallazgos menores sin ventajas específicas de Mythos
Verificación de la evidencia presentada por el gobierno
- Hasta ahora, el gobierno solo ha presentado evidencia verbal, y esta se refiere a un jailbreak no universal de alcance limitado en el que se pide al modelo leer una base de código específica y corregir defectos de software
- Anthropic entiende que solo se compartió con el gobierno un posible jailbreak, y al revisar el informe que se presume sirvió de base para la orden, concluyó que el nivel de capacidad mostrado también está ampliamente disponible en otros modelos, como GPT-5.5 de OpenAI
- Se trata de capacidades que los defensores usan todos los días para proteger sistemas
- La empresa dice que compartirá más detalles dentro de las próximas 24 horas
Respuesta y postura de Anthropic
- Anthropic cumplió la orden legal del gobierno y eliminó el acceso a Fable 5 y Mythos 5 para todos los usuarios
- Sin embargo, no está de acuerdo con que el descubrimiento de un posible jailbreak de alcance limitado sea motivo suficiente para retirar un modelo comercial desplegado para cientos de millones de personas
- Considera que, si se aplicara el mismo criterio a toda la industria, el despliegue de nuevos modelos de todos los proveedores frontier quedaría prácticamente paralizado
- La empresa sostiene que el gobierno debe tener autoridad para bloquear despliegues inseguros, pero que eso debe formar parte de un proceso legal transparente, justo, claro y basado en hechos técnicos, y que esta medida no cumple con esos principios
- Pide disculpas por la confusión causada a los clientes, considera que se trata de un malentendido y está trabajando para restaurar el acceso lo antes posible
9 comentarios
Por más que lo vea, parece que después de armar tanto alboroto diciendo una y otra vez que su modelo era peligroso, al final se terminaron disparando al pie.
No sé si esto será un éxito o un fracaso de marketing en el futuro, pero por ahora se ve como un fracaso.
Considerando la afluencia de usuarios a Anthropic después del incidente del Pentágono, creo que en este momento, con la IPO cerca, no hay forma de que Anthropic salga perdiendo.
Además, también les vendría perfecto para tapar temas como los guardrails, porque si de entrada simplemente dejan de ofrecer el modelo como servicio, ya no se podrá seguir verificando.
No sé si sea solo con Mythos y Fable, pero si siguen bloqueando así también a los modelos futuros, terminará siendo casi como decir que no les van a dejar ganar dinero... probablemente...
Ah, no lo había pensado.
Parece que las empresas de IA ya no tienen motivos para desarrollar modelos con mejor rendimiento. Da la impresión de que el avance de la IA llega hasta aquí.
Jajajajajajajajajajajajajajaja
Opiniones en Lobste.rs
Me parece que la estrategia del gobierno de EE. UU. de transmitirle al mundo que no se puede confiar ni depender de los servicios digitales estadounidenses es miope, y terminará siendo una gran oportunidad para competidores de otros países
Me impresiona ver a esta administración torpedear por completo la hegemonía de EE. UU. en el mundo
Creo que hay una probabilidad bastante alta de que esto sea manipulación del mercado por parte del gobierno estadounidense para beneficio privado
Si el mercado se hunde el lunes, probablemente compren barato y luego reviertan la decisión cuando llegue el momento de vender. Ya ha pasado muchas veces con el vaivén de los aranceles, y lo siguieron haciendo hasta que el mercado detectó el patrón
El resultado algo positivo, al menos, es que la soberanía europea en IA ahora podría empezar a tomarse en serio. Frente a una situación percibida como un ataque, parece que la actitud vacilante de la UE respecto a la IA podría desaparecer
Qué herramienta de marketing tan extraña. Veamos cómo evoluciona
He visto muchas reacciones así, pero para mí no tienen ningún sentido
No lo entiendo. ¿Qué tiene exactamente de tan peligroso un modelo de lenguaje grande? No parece tan difícil encontrar en línea cómo fabricar bombas o armas químicas
Tal vez necesites instalar el navegador Tor, aunque ni siquiera estoy seguro de que eso sea indispensable. El terrorismo es raro porque la mayoría de la gente no quiere fabricar bombas ni matar a quienes la rodean, no porque esa información esté muy bien escondida
¿Será que estoy demasiado metido en una burbuja ludita? En el trabajo definitivamente destaco como escéptico del vibe coding, así que sigo las corrientes recientes, desde MCP hasta agentes y skills, a través de colegas que presumen su productividad con entusiasmo
¿O será que en los datos de entrenamiento hay material confidencial?
Mi suposición es que el gobierno de EE. UU. podría estar tomando represalias porque no le gustó que Anthropic se negara a trabajar en robots asesinos militares. O quizá alguien esté ganando mucho dinero en Polymarket
También podría haber un miedo real a cosas como el hacking. Pero si ese fuera el caso, entonces sería lógico que GPT 5.5 también hubiera quedado prohibido
La idea es que un modelo de lenguaje grande dentro de un conjunto de herramientas suficientemente capaz podría automatizar el desarrollo de virus o guiar el proceso paso a paso. No estoy seguro de si eso es cierto, de si Anthropic realmente lo cree, o de si el gobierno de EE. UU. se cree ese argumento. Obviamente también puede haber otros motivos
Anthropic sí llegó a decir, en la práctica, que Mythos es la bomba atómica del mundo de la seguridad informática
Un poco fuera de tema, pero creo que cuestiones como el jailbreak sí pueden llevar a debates valiosos
Es una excelente herramienta de marketing. El mensaje es que nuestro modelo está tan avanzado que asusta al gobierno
Es bastante interesante que esta medida también afecte a personas sin nacionalidad estadounidense que viven en EE. UU. y trabajan en Anthropic
Suena bastante complicado de manejar internamente. No conozco bien cómo funciona este ámbito en EE. UU., así que me pregunto cómo encaja una medida así con las reglas antidiscriminación en el empleo
¿Qué es esto? jaja
Comentarios en Hacker News
Han estado haciendo marketing del miedo para vender el modelo como si estuviera muchísimo más adelantado que los demás, así que ahora les tocó pagar el precio
Parece que por fin encontraron al público adecuado de tontos que se lo creyera
Casi se puede oír a muchísimas empresas y usuarios apostando con más fuerza por los modelos chinos
Que otros países tengan acceso a estos modelos puede ser un tema de seguridad nacional para EE. UU. Pero ahora depender de estos modelos, y más ampliamente de la tecnología estadounidense en general, también se vuelve un tema de seguridad nacional para otros países
Viéndolo lógicamente, ¿no queda más que concluir que EE. UU. llegó al límite superior de capacidad de modelos que está dispuesto a permitir al público? Con un precedente así, ¿quién va a invertir en modelos aún más inteligentes?
Y quizá más importante: si un modelo como Mythos, que como mucho es una mejora incremental frente a Opus, recibe este trato, ¿cómo se recupera cualquier inversión en IA basada en la premisa de ASI/AGI/modelos mucho mejores?
Si OpenAI o Grok estuvieran operando al mismo nivel, da la impresión de que no habrían recibido el garrote del gobierno
ChatGPT 2 también fue considerado en su momento demasiado poderoso para hacerse público
La IA ha avanzado más rápido que la cultura y la forma de pensar. Una vez que nos adaptemos a lo que estos modelos pueden hacer, se aflojará un poco la situación, y luego la siguiente mejora escalonada hará que todo se repita otra vez. Siempre pasa así
Esto es resultado del espectáculo estilo estadounidense alrededor de los modelos de lenguaje a gran escala. Esta vez simplemente les salió al revés
De ahora en adelante, sean realmente peligrosos o no los modelos, las afirmaciones de riesgo sobre modelos futuros probablemente desaparecerán
Si el gobierno puede ordenar arbitrariamente suspender el uso de un modelo a todos los extranjeros, dentro y fuera de EE. UU., nadie querrá asumir el riesgo de construir algo importante sobre estos modelos. Al final, será cuestión de tiempo para que empresas extranjeras alcancen ese nivel y se queden con el mercado comercial de estos modelos. Solo que EE. UU., como suele hacer, probablemente prohibirá a los competidores, así que en la práctica podría terminar habiendo un backend distinto solo dentro de EE. UU.
Con escasez mundial de petróleo, escasez de fertilizantes e intervenciones torpes para inflar la burbuja, casi habría que dar gracias de que al volante esté un stable genius octogenario senil que desprecia el Estado de derecho y tiene veintidós especialistas
Desde la perspectiva de las grandes empresas o de organizaciones con cierto tamaño, es difícil asumir la amenaza de que algo así pueda desactivar de repente una pieza central de la infraestructura. La presión por el acceso on-premises y offline va a crecer de forma abrumadora, y ya sea con licencias de pesos o con entornos restringidos como TEE/CC, alguien va a cubrir esa demanda
Algunos asumirán más riesgo y ganarán o perderán, mientras que otros se moverán con más seguridad y acumularán resultados lentamente o quedarán atrás
Ni hablar de la amenaza de poner a estos modelos a escribir el código que opera el trabajo de una empresa o a actuar como agentes. Incluso podría tratarse de un modelo entrenado por actores cuyos intereses son exactamente opuestos a los tuyos, ya sean empresas o Estados
Ahora hay muchas más cosas que considerar, y es una época interesante para hacer negocios
Incluso si alquilas un modelo abierto de una empresa china, si te cortan el acceso o cambian los términos de una forma que no te gusta, puedes pasar a on-premises. Puede ser molesto, pero no amenaza tu supervivencia. En cambio, si dependes de un modelo cerrado y te lo cortan, el dolor puede ser enorme
La gran cuestión aquí es el dominio de la infraestructura. Los modelos chinos se convertirán en los modelos que la gente realmente usa y, al hacerlo, van a definir los estándares. Entonces se formarán más investigación, más herramientas y todo el ecosistema a su alrededor
Incluso antes de este alboroto, esa tendencia ya había empezado, con modelos chinos convirtiéndose en los más usados del mundo. https://www.indiatoday.in/amp/technology/features/story/clau...
Si te pasas mucho tiempo hablando de lo peligroso que es tu producto, puede que quienes tienen autoridad para sacar del mercado productos peligrosos te escuchen
Más aún si esas personas no son especialmente brillantes en este momento y además ya están molestas con Anthropic porque no les está ayudando a cumplir objetivos autoritarios aparte
No creo que esto sea ajedrez 3D de Anthropic. No son los genios estrategas entre bambalinas que les gustaría ser. Quienes realmente han usado el producto saben que Fable y Mythos no son dispositivos del fin del mundo, sino mejoras graduales. Esto me parece una medida punitiva de una administración aficionada al castigo, y Anthropic reforzó sin querer la justificación con su retórica absurda
Dice que esto ocurrió hoy a las 5:21 p. m. hora del Este
La página mostraba 11 de junio de 2026, y en los últimos 10 minutos se actualizó a 12 de junio de 2026
https://imgur.com/a/lx7HCW9
Google muestra que esta página fue rastreada hace varios días
Solo busca “the us government directive to suspend access to fable”
https://imgur.com/a/EOWWUbD
Incluso si están en EE. UU. o son empleados de Anthropic, impedir que los ciudadanos extranjeros lo usen, sin importar de qué país sean, parece excesivamente amplio y severo. Y que sea, aparentemente, por una sola vulnerabilidad potencial de jailbreak bastante menor sugiere que hay algo más de lo que se ve
No significa que sea un buen resultado para los investigadores ni para la investigación en sí. Es más bien una especie de seguro sobre el uso de fondos ordenado por EE. UU.