Tras su regreso una parte considerable de sus usuarios asegura que no es el mismo. Anthropic dice que sí. Esa contradicción, más que el veto en sí, es el episodio más revelador sobre cómo se va a regular la IA de frontera.
El 9 de junio de 2026, Anthropic lanzó Claude Fable 5 como el modelo más capaz de su catálogo. Tres días después, el gobierno de Estados Unidos ordenó su retirada. Tres semanas más tarde, el modelo volvió — pero una parte considerable de sus usuarios asegura que no es el mismo. Anthropic dice que sí lo es. Esa contradicción, más que el veto en sí, es el episodio más revelador sobre cómo se va a regular la IA de frontera.
Desde su regreso del 1 de julio, las quejas se han acumulado con una consistencia que va más allá de la anécdota aislada. Usuarios describen al Fable 5 restaurado como «recortado», «enjaulado» o directamente «lobotomizado» en tareas de programación y depuración.
El patrón más citado, documentado por desarrolladores en foros como Reddit, es un comportamiento de fallback: el modelo desvía silenciosamente ciertas solicitudes hacia Opus 4.8 en lugar de resolverlas con sus propias capacidades, incluso cuando la tarea no tiene ninguna carga de riesgo evidente.
Cronología de un apagón de tres semanas
El detonante llegó rápido. El 12 de junio, apenas 72 horas después del lanzamiento, el gobierno estadounidense emitió una directiva de control de exportación invocando seguridad nacional, después de que investigadores de Amazon reportaran una técnica capaz de usar Fable 5 para identificar de forma sistemática vulnerabilidades de software. La directiva no distinguía matices: exigía suspender el acceso a Fable 5 y a su modelo hermano, Mythos 5, para cualquier usuario fuera de ciertos perímetros autorizados. En la práctica, Anthropic no tenía forma de segmentar ese cumplimiento sin apagar el modelo por completo, así que lo hizo para todo el mundo.
El apagón se extendió más de lo que cualquier lanzamiento de este tipo había anticipado. El 26 de junio el gobierno autorizó un redespliegue limitado; el 30 de junio levantó las restricciones por completo, y el 1 de julio Fable 5 volvió a estar disponible de forma global. Según cómo se cuente — desde la directiva hasta el levantamiento, o hasta el regreso efectivo — el bloqueo duró entre 18 y 19 días.
El arreglo: un clasificador, no un rediseño
La respuesta técnica de Anthropic durante ese lapso fue puntual: entrenar un clasificador de seguridad dirigido específicamente a la técnica de jailbreak reportada por Amazon, capaz de bloquearla en más del 99% de los intentos. La compañía ha sido consistente en su versión de los hechos: el modelo base — sus pesos, su arquitectura, su entrenamiento — no cambió. Lo que se añadió fue una capa de filtrado sobre la salida del modelo, no un nuevo modelo.
Esa distinción, sin embargo, es precisamente donde empieza el desacuerdo.
Lo que reportan los usuarios
Desde el regreso del 1 de julio, las quejas se han acumulado con una consistencia que va más allá de la anécdota aislada. Usuarios describen al Fable 5 restaurado como «recortado», «enjaulado» o directamente «lobotomizado» en tareas de programación y depuración. El patrón más citado, documentado por desarrolladores en foros como Reddit, es un comportamiento de fallback: el modelo desvía silenciosamente ciertas solicitudes hacia Opus 4.8 en lugar de resolverlas con sus propias capacidades, incluso cuando la tarea no tiene ninguna carga de riesgo evidente.
El caso más citado es el de un desarrollador de sistemas que reportó que el modelo se volvía prácticamente inutilizable en su flujo de trabajo: referencias a lenguajes como C, C++, Rust o a la Win32 API, o archivos que simplemente contenían palabras como «security», «vulnerable», «unsafe» o «hook», parecían disparar bloqueos o el desvío automático hacia otro modelo — sin relación aparente con el uso real que se le estaba dando al código.
A esto se suman cifras de benchmarks no oficiales que circulan entre usuarios (bajo el nombre «BridgeBench») y que muestran caídas pronunciadas en tareas concretas: el desempeño en debugging habría pasado de 86.2 a 25.9, la refactorización de 73.6 a 38.4, y el manejo de alucinaciones de 75.9 a 61.7. Es una salvedad importante: estos números provienen de pruebas de terceros, no de Anthropic, y no han sido verificados de forma independiente ni sometidos a una metodología pública auditable. Deben leerse como una señal de la percepción de la comunidad, no como una medición concluyente.
Dos versiones que, en realidad, no se contradicen
Puestas una junto a la otra, la versión de Anthropic («el modelo no cambió») y la de los usuarios («el modelo es más débil») parecen incompatibles. No lo son necesariamente. Un clasificador de seguridad que se dispara sobre una superficie más amplia de lo previsto — bloqueando o redirigiendo solicitudes legítimas de código porque comparten patrones superficiales con la técnica de jailbreak que motivó el veto — produce exactamente el síntoma que describen los usuarios: el modelo «se siente» menos capaz, aunque los pesos subyacentes sean idénticos a los de antes del 12 de junio.
Dicho de otro modo: es probable que ambas partes tengan razón sobre lo que afirman y se equivoquen sobre lo que eso implica. Anthropic tiene razón en que no hubo un reentrenamiento que redujera capacidades. Los usuarios tienen razón en que la experiencia real —la tasa de éxito en tareas cotidianas de código— se deterioró. El punto de fricción es que un clasificador más agresivo, calibrado deprisa bajo presión regulatoria y con el objetivo explícito de blindar el 99% de los intentos de jailbreak, casi inevitablemente sacrifica precisión en el otro sentido: más falsos positivos, más tareas benignas bloqueadas o desviadas.
Hasta el momento de esta publicación, Anthropic no se ha pronunciado públicamente sobre estos reportes de falsos positivos ni ha anunciado un ajuste al clasificador.
Por qué esto importa más allá de Fable 5
El episodio deja un precedente que trasciende a un solo modelo. Es la primera vez que un gobierno ordena la retirada total de un modelo de IA de frontera ya desplegado comercialmente, y lo hizo con una directiva que no dejó margen para una respuesta técnica matizada — solo apagar o cumplir. La solución de Anthropic, un clasificador reactivo desplegado bajo presión de tiempo, es probablemente la respuesta más razonable disponible en esas condiciones, pero también ilustra un patrón que probablemente se repita: cuando la seguridad se impone por mandato regulatorio y con plazos cortos, el costo se traslada a la usabilidad, y ese costo lo terminan pagando los usuarios legítimos, no los actores maliciosos que motivaron la medida.
La pregunta de fondo, entonces, no es solo si Fable 5 es «el mismo modelo». Es si este tipo de intervención — gobierno ordena, empresa parchea a contrarreloj, usuarios absorben la fricción — se convierte en el mecanismo estándar de gobernanza para la próxima generación de modelos de frontera. Si es así, el verdadero producto de este episodio no es un clasificador más estricto, sino un molde institucional para cómo se va a negociar, de aquí en adelante, la tensión entre capacidad y control.