El despliegue comercial de los modelos mas avanzados de Anthropic ha durado apenas 72 horas. El 9 de junio de 2026 la empresa lanzó Claude Fable 5, su primer modelo de clase Mythos accesible al público, junto a Claude Mythos 5, reservado a un grupo de socios verificados. El 12 de junio, una directiva de control de exportaciones del gobierno de Estados Unidos obligó a Anthropic a impedir el acceso al modelo desde fuera de EEUU, o desde dentro a extranjeros, lo que obligó en la práctica a suspender el acceso a ambos a escala global. El caso es relevante no solo por lo abrupto de la medida, sino porque parece ser la primera vez que una intervención gubernamental retira de circulación un modelo de IA ya desplegado comercialmente.
Qué se lanzó y qué es la clase Mythos
La familia Mythos es un nivel de modelos que Anthropic sitúa en capacidad por encima de su clase Opus. El primero fue Claude Mythos Preview, liberado en abril a un grupo reducido de organizaciones a través del programa Project Glasswing y orientado a investigación de seguridad. Algunos participantes reportaron haber identificado y corregido numerosos fallos con su ayuda. Mozilla, por ejemplo, afirmó haber resuelto cientos de vulnerabilidades.
Fable 5 y Mythos 5 comparten el mismo modelo subyacente y se diferencian sobre todo en sus controles de salida. Fable incorpora una capa de clasificadores que bloquea o redirige las respuestas en áreas de alto riesgo, como la ciberseguridad, mientras que Mythos 5 opera con parte de esas restricciones levantadas y queda limitado a determinadas organizaciones "confiables".
Las críticas previas a la suspensión
Desde el primer día, el lanzamiento recibió objeciones. La más repetida apunta a unas salvaguardas excesivamente amplias. Cuando una consulta activaba el clasificador, Fable 5 no rechazaba la petición de forma explícita, sino que la redirigía de forma silenciosa al modelo inferior Claude Opus 4.8. Los críticos sostienen que ese repliegue encubierto generaba una falsa sensación de seguridad y frustraba a los investigadores legítimos, que veían degradada la respuesta sin aviso claro. La propia Anthropic ha admitido que muchos usuarios consideraron las salvaguardas demasiado amplias.
A esto se sumaron quejas por el consumo de tokens, por unos límites de uso restrictivos y por la política de retención de datos de 30 días que Anthropic impuso a Fable, una medida que la empresa justifica como necesaria para investigar y mitigar elusiones de las salvaguardas, pero que tuvo coste con clientes. Microsoft, de hecho, llegó a restringir el acceso de sus empleados por las dudas en torno a esa retención.
Por nuestra parte, en el escaso tiempo en que tuvimos acceso, nuestra impresión fue que Fable 5 operaba a un nivel más avanzado que los modelos anteriores. En tareas de revisión de scripts en Python (desarrollados con ayuda de Opus 4.8), Fable 5 localizó algún fallo real que había pasado inadvertido, por ejemplo una consulta SQL compleja, cuyo límite de resultados no se aplicaba correctamente y operaba sobre un rango mayor del previsto. En ningún caso errores bloqueantes, pero sí del tipo que solo aflora en producción bajo condiciones concretas.
Las reclamaciones de jailbreak: dos relatos distintos
Varias fuentes distintas afirman haber roto las salvaguardas del modelo
Por un lado, en público. Un investigador conocido por el alias Pliny the Liberator, afirmó en twitter haber "liberado" Fable 5 pocos días después del lanzamiento. Según ha explicado, empleó tácticas de prompting multiagente, ofuscación de caracteres y aprovechamiento del contexto largo. Pliny sostuvo haber obtenido información sobre temas sensibles y publicó capturas, además de lo que presentó como el system prompt interno del modelo. Conviene advertir que se trata de afirmaciones del propio investigador, no verificadas de forma independiente, y que el supuesto system prompt filtrado no ha sido confirmado por Anthropic. En cualquier caso, se trata de instrucciones de tono, formato y lógica de rechazo, sin nada que constituya una capacidad sensible.
La base de la actuación gubernamental parece haber sido otra. Según Axios, un funcionario de la administración explicó que el Departamento de Comercio actuó después de que otra empresa afirmara haber jailbreakeado Mythos, y que la administración ya había intentado sin éxito frenar el lanzamiento antes de enviar la carta. Es decir, el detonante oficial apunta a un reporte de una compañía, no al post público de Pliny.
La distinción importa, porque la descripción técnica que da Anthropic de la técnica que motivó la orden no coincide con el jailbreak que se aireó en redes.
La directiva del 12 de junio
La orden, amparada en normativa de control de exportaciones y citando seguridad nacional, prohibía el acceso a Fable 5 y Mythos 5 a cualquier ciudadano extranjero, dentro o fuera de Estados Unidos, incluidos los empleados extranjeros de la propia Anthropic. Es imposible pasar por alto la paradoja: al prohibir el acceso a "cualquier ciudadano extranjero, dentro o fuera de EE.UU., incluidos los empleados extranjeros de Anthropic", el gobierno está diciéndole a la empresa que algunas de las personas que probablemente construyeron Fable 5 (talento importado) ya no pueden ni tocarlo. La tecnología que crearon queda, en la lógica del deemed export, "exportada" hacia ellos si se la dejan usar.
Dado que cumplir de forma selectiva habría obligado a bloquear a una parte enorme de usuarios y de su propia plantilla, la empresa optó por suspender el acceso a ambos modelos para todos los clientes del mundo. El resto de modelos de Claude, incluido Opus 4.8, sigue operativo. La directiva exige además licencia para la exportación, reexportación o transferencia interna de los modelos de Anthropic.
La respuesta de Anthropic
La empresa califica lo sucedido de malentendido. Sostiene que la carta no detallaba la preocupación concreta y que la técnica demostrada era un jailbreak limitado y no universal: en esencia, pedir al modelo que leyera un código base concreto y corrigiera fallos de software. Las vulnerabilidades que afloraban eran, según Anthropic, previamente conocidas y relativamente menores, y otros modelos públicos las encuentran sin necesidad de bypass. La compañía citaba expresamente a GPT-5.5 de OpenAI como ejemplo de modelo con capacidad comparable que no está sujeto a un control similar.
Anthropic asume que la resistencia perfecta a los jailbreaks no es hoy posible para ningún proveedor, por lo que busca que las fugas sean puntuales o muy caras de producir, y las combina con monitorización para detectarlas y cerrarlas. Su argumento de fondo es que retirar un modelo desplegado a cientos de millones de personas por una fuga limitada sentaría un precedente que, aplicado al sector, paralizaría el despliegue de cualquier modelo de frontera.
Los roces de Anthropic con la Administración USA no son nuevos. El pasado febrero el Departamento de Defensa de EEUU designó a Anthropic como "riesgo para la cadena de suministro de seguridad nacional", ante la negativa de Anthropic a permitir que el ejército usara Claude para vigilancia o armas autónomas. Anthropic logró bloquear temporalmente la designación solicitando una medida cautelar. En cuanto a la retirada actual de los modelos fable 5 y mythos 5, fuentes no confirmadas señalan que podría ser levantado "en semanas", "cuando el aparato de seguridad nacional esté reforzado". Anthropic no ha adelantado ningún plazo , aunque afirma estar trabajando para restaurar el acceso lo antes posible.