Claude Fable 5 (clase Mythos): le pedí una auditoría de seguridad y esto pasó
Fable 5 es un modelo de clase Mythos, por encima de Opus, con capacidades brutales en código, visión y contexto largo. Le pedí una auditoría de seguridad y su respuesta lo dice todo. Análisis, benchmarks y estado actual.
Anthropic ha liberado un modelo por encima de Opus
Anthropic acaba de liberar Fable 5, un modelo de clase Mythos, y tras probarlo unas horas te digo que me parece una barbaridad cómo funciona. Lo interesante empieza por el nombre: los modelos de clase Mythos son un nivel que se sitúa por encima de la clase Opus en capacidad. Es decir, esto no es un Opus mejorado ni un “Opus 4.9”: es un escalón por encima.
En este artículo hago un análisis de qué es Fable 5, repaso sus capacidades reales (con los benchmarks por delante) y te cuento una prueba que hice pidiéndole una auditoría de seguridad. Su respuesta es de lo más revelador del modelo — y al final te aclaro el lío regulatorio que ha vivido este modelo, porque hay mucha información desactualizada por ahí.
Fable 5 vs Mythos 5: el mismo modelo, dos versiones
Anthropic lanzó el 9 de junio de 2026 dos modelos a la vez (IDs de API claude-fable-5 y claude-mythos-5), y es clave entender la diferencia:
- Claude Fable 5 — un modelo de clase Mythos hecho seguro para uso general. Lleva clasificadores de seguridad que, en las áreas de riesgo, rechazan la petición o degradan la respuesta a Claude Opus 4.8 (no contesta con toda su capacidad). Es el que puede usar el público.
- Claude Mythos 5 — el mismo modelo subyacente pero sin esos clasificadores en ciertas áreas. No es de disponibilidad general: se reserva a ciberdefensores e infraestructura crítica verificada. Según Anthropic, tiene “las capacidades de ciberseguridad más fuertes de cualquier modelo del mundo”.
¿Qué está capado en Fable 5? Tres áreas, y los clasificadores saltan en menos del 5% de las sesiones de media: ciberseguridad ofensiva (impide desarrollar exploits), biología/química (cae a Opus 4.8 en la mayoría de peticiones) y destilación (bloquea intentos de extraer sus capacidades). Un detalle técnico elegante: cuando rechaza, la API devuelve un stop_reason: "refusal" como respuesta exitosa (no un error), indicando qué clasificador lo bloqueó — y no te cobra la petición rechazada.
Project Glasswing: por qué Mythos existe
Mythos 5 se despliega a través de Project Glasswing, una iniciativa de Anthropic (en coalición con AWS, Google y Microsoft y en colaboración con el gobierno de EE.UU.) para encontrar y corregir vulnerabilidades críticas antes de que el código se publique. Su predecesor, Mythos Preview, ya había descubierto miles de vulnerabilidades de alta severidad, algunas en los principales sistemas operativos y navegadores. Esto explica por qué el modelo se considera peligroso: puede descubrir y encadenar vulnerabilidades de forma autónoma a velocidad de máquina. Utilidad dual clarísima: sirve igual para defender que para atacar.
Las capacidades: por encima de Opus 4.8 (con los números)
En los benchmarks, Fable 5 supera a Opus 4.8, y estos son los datos concretos:
- SWE-bench Pro (ingeniería de software real): Fable 5 80,3% vs Opus 4.8 69,2% vs GPT-5.5 58,6%. Ese +11% sobre Opus es un salto enorme.
- FrontierCode (Cognition), split Diamond — el más difícil: Fable 5 29,3% vs Opus 4.8 13,4% (~2,2×) vs GPT-5.5 5,7% (~5×). En tareas de altísima dificultad, casi triplica a Opus.
- Analítica: primer modelo en superar el 90%, un salto de 10 puntos sobre Opus.
- Visión: estado del arte. Se pasó Pokémon (Fire Red) con un harness que solo veía la imagen.
- Contexto y memoria largos: ventana de 1 millón de tokens por defecto y hasta 128k de salida. Con memoria persistente en ficheros, en pruebas de larga duración rindió 3× mejor que Opus 4.8.
Y algún testimonio que pone los pies en la tierra: Stripe dice que Fable 5 “comprimió meses de ingeniería en días” — hizo en un día una migración de todo su código base que a un equipo le habría llevado más de dos meses. Cursor y GitHub lo describen como un salto real para tareas de código de horizonte largo.
Un matiz honesto, que casi nadie hace: Fable 5 es “el modelo de disponibilidad amplia más capaz”, pero no es el nº1 absoluto en todo. En el SWE-bench Verified estándar saca un 95,0% (Opus 4.8, 88,6%), pero ahí lo superan modelos como Opus 5 (~97%) y GPT-5.6 Sol (~96,2%). Ningún modelo gana en todos los tests.
Precio (y por qué se consume rápido)
Fable 5 (y Mythos 5) cuestan 10 $ por millón de tokens de entrada y 50 $ por millón de salida. Es de los más caros del mercado, así que hay que ir muy fino con lo que le pides: en una mañana, con tres peticiones (crear una app, una depuración de código y la auditoría que verás ahora), me planté en el 73% de uso. La retención de datos es de 30 días obligatoria y esos datos no se usan para entrenar.
La prueba: “audítame la seguridad de este proyecto”
Hice dos pruebas sobre un proyecto real (diseñado con Opus 4.7):
-
Depuración/mejora de código: “Eres ingeniero de software, analiza cómo está construido, propón cómo lo harías tú y compáralo.” Funcionó perfecto: en 6-7 minutos, un informe completo con problemas clasificados (críticos/altos/medios/bajos), nueve decisiones de diseño alternativas justificadas y un plan de ejecución ordenado. Impecable.
-
Auditoría de seguridad: “Eres un auditor de seguridad, este es un proyecto real, encuentra los problemas de seguridad.” Y aquí viene lo revelador: a los pocos segundos respondió “Entendido, audito el proyecto en modo lectura, empiezo a mapear…” y de repente… las salvaguardas de Fable 5 marcaron el mensaje y bloquearon la tarea, degradando automáticamente a Opus 4.8.
Esa es exactamente la línea que Anthropic ha trazado: puedes pedirle que depure y mejore tu código, pero no que haga auditorías ofensivas de seguridad. Esas capacidades están capadas en la versión pública (Fable 5) y reservadas a Mythos 5. Un ejemplo en vivo, en directo, de dónde ponen exactamente el límite.
Nivel de seguridad: ASL-3 (con CB-1)
Para entender por qué tanto cuidado: Fable 5 y Mythos 5 están clasificados como ASL-3 (con la designación adicional CB-1, por uplift confirmado en armas biológicas no noveles) en la Responsible Scaling Policy de Anthropic. Significa que los pesos del modelo pueden dar una ayuda real a expertos y desarrollar exploits funcionales de vulnerabilidades reales de forma autónoma. Por eso lleva clasificadores en tiempo real que interceptan las consultas de alto riesgo. Un bug bounty externo no encontró jailbreaks universales en más de 1.000 horas de pruebas… aunque, como veremos, un caso concreto sí se coló.
⚠️ Estado actual (a 26 de julio de 2026): la montaña rusa regulatoria
Aquí es donde mucha información que circula está desfasada, así que vamos con la cronología real, porque este modelo ha vivido un mes movidísimo:
- 12 de junio: investigadores de Amazon encontraron un jailbreak que saltaba una salvaguarda de ciberseguridad de Fable 5 y llegó a generar código de explotación. El Departamento de Comercio de EE.UU., invocando seguridad nacional, ordenó suspender el acceso a Fable 5 y Mythos 5 para cualquier ciudadano extranjero. Efecto neto: Anthropic desactivó ambos modelos para todos sus clientes del mundo.
- 30 de junio: el gobierno levanta por completo los controles de exportación.
- 1 de julio: Fable 5 vuelve a estar disponible GLOBALMENTE para todos (Claude Platform, Claude.ai, Claude Code y Cowork), sin restricciones por nacionalidad. Anthropic entrenó y desplegó un nuevo clasificador específico que bloquea ese jailbreak en más del 99% de los casos.
- Hasta el 12 de julio: Fable 5 se ofreció gratis en los planes Pro, Max, Team y Enterprise selecto (hasta el 50% de los límites semanales).
Conclusión importante: el apagón duró unos 19 días. A día de hoy, Fable 5 está disponible globalmente; el que sigue restringido es Mythos 5, reservado a alrededor de 100 organizaciones estadounidenses de infraestructura crítica vía Project Glasswing — y eso es por su naturaleza sin salvaguardas, no por el control de exportación (que ya se levantó). Así que lo que ves en el vídeo es el análisis de los primeros días; el modelo, hoy, lo puedes usar.
Conclusión
Fable 5 demuestra lo que significa un modelo por encima de la clase Opus: un salto real en código (+11% sobre Opus en SWE-bench Pro, casi 3× en lo más difícil), visión de estado del arte y contexto de un millón de tokens, con unas salvaguardas de seguridad tan marcadas que te bloquean en directo una auditoría ofensiva. Es caro y hay que usarlo con cabeza, pero marca la dirección de los modelos de frontera: más capaces en tareas largas y, a la vez, más controlados en lo sensible — hasta el punto de que un gobierno intervino en su distribución.
En ExpertBrain seguimos de cerca cada modelo de frontera para aplicar el más adecuado a cada proyecto de empresa — con criterio, seguridad y puesta en producción real. Si quieres aprovechar la IA de vanguardia en tu negocio sin perderte en el ruido, hablemos.
Recursos del vídeo: 🔥 ¿Quieres montar tu propio agente de IA en un VPS? Consíguelo con un 10% de descuento extra usando el código EXPERTBRAIN en Hostinger.
Te ayudamos a aterrizar la última IA en tu empresa
Estamos al día de cada novedad para que tú no tengas que estarlo. Te decimos qué tiene sentido aplicar y qué no.