Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1, tres meses después de que se lanzara la línea Fable 5 en junio de 2026. Los dos son el mismo modelo subyacente detrás de diferentes capas de protección. Fable 5.1 está disponible generalmente como claude-fable-5-1; Mythos 5.1 permanece restringido a organizaciones examinadas. Ambos tienen una ventana de contexto de token de 1 millón y un máximo de 128 000 tokens de salida, con el pensamiento adaptativo siempre activo. La cifra de capacidad principal es del 52,6% en Terminal-Bench-Science 0.1, frente al 24,7% de Fable 5 y el 29,0% de Opus 5. La cifra comercial principal es un recorte del 75% en las lecturas de caché, de $1,00 a $0,25 por millón de tokens, lo que Anthropic mide como aproximadamente un 25% menos de costo en cargas de trabajo típicas y hasta un 45% en cargas de agente. El precio base de insumos y productos se mantiene sin cambios en $10 y $50 por millón.
¿Es desplegable?
Sí, Claude Fable 5.1 está disponible generalmente como claude-fable-5-1 en Claude API, Amazon Bedrock, Claude Platform en AWS, Google Cloud y Microsoft Foundry. Claude Mythos 5.1 no lo es: está restringido a organizaciones estadounidenses examinadas dentro del Proyecto Glasswing.
Los números de referencia
En Terminal-Bench-Science 0.1, un punto de referencia de investigación científica agente, Fable 5.1 obtiene una puntuación del 52,6% frente al 29,0% de Opus 5, el 24,7% de Fable 5 y el 22,4% de GPT-5.6 Sol. Anthropic informa un error estándar de 3,5 a 4,5 puntos por modelo, por lo que debe tratar el margen, no la clasificación, con cuidado.
En Terminal-Bench 4.0, Fable 5.1 alcanza el 55,8% y Mythos 5.1 alcanza el 60,9%. La brecha entre dos modelos idénticos es el costo de las intervenciones de salvaguardia, lo cual es una revelación inusualmente honesta. En otros lugares: CursorBench 3.2.0 con 73,4%, Humanity’s Last Exam con 60,9% sin herramientas y 65,0% con herramientas, AutomationBench con 31,4%, OSWorld 2.0 con 41,7% estricto y GDPval-AA v2 con 1853.
De dónde viene el recorte de costes
El precio base de insumos y productos no cambia. Las lecturas de caché caen un 75%, de $1,00 a $0,25 por millón de tokens, lo que es 0,025 veces la entrada base frente a 0,1 en todos los demás modelos de Claude. Anthropic mide aproximadamente un 25 % menos de costo en cargas de trabajo típicas y hasta aproximadamente un 45 % en cargas de agente con mucho contexto. El procesamiento por lotes cuesta $5 y $25 por millón de tokens.
Los equipos lograrán tres cambios importantes
El uso forzado de herramientas desapareció: tool_choice establecido en cualquiera o herramienta devuelve un 400. En su lugar, use auto con uso estricto de herramientas o salidas estructuradas. Los bloques de pensamiento están ligados al modelo: Fable 5.1 lee el pensamiento de los modelos anteriores, pero ningún modelo anterior lee el suyo propio. Las configuraciones de enrutador y respaldo pierden sentido cuando se apagan. Editar turnos anteriores invalida los bloqueos de pensamiento: inyectar y eliminar recordatorios por turno, o reconstruir el sistema o la matriz de herramientas en mitad de una conversación, ahora son errores. La verificación se aplica a las cuentas creadas a partir del 31 de agosto de 2026. Las correcciones son mensajes del sistema con alcance por turnos y edición de contexto del lado del servidor.
Cambios adicionales: esfuerzo por mensaje, mensajes del sistema con alcance por turnos y think.display: las “actualizaciones” están todas en versión beta detrás de los encabezados. La procedencia del contenido no es opcional, con una marca de agua de texto estadística en todos los resultados y credenciales C2PA en los archivos.
Anthropic también documenta regresiones reales. Las llamadas de herramientas paralelas son más variables, por lo que los bucles de agentes pueden emitir una llamada por turno, mientras que Fable 5 agrupa varias. El modelo narra menos, responde de memoria con mayor frecuencia con poco esfuerzo y prefiere reescrituras de archivos completos a ediciones específicas.
Salvaguardias y ciencia
Las salvaguardas cibernéticas ahora permiten descubrir vulnerabilidades pero no desarrollar vulnerabilidades, lo que reduce las intervenciones en Claude Code en aproximadamente un 60 % por sesión. Las salvaguardias biológicas se activan con un 85% menos de frecuencia ante solicitudes benignas. Las pruebas de penetración, la generación de exploits y el escaneo de vulnerabilidades basado en binarios aún redirigen a Opus.
En la investigación, Mythos 5.1 diseñó aglutinantes de proteínas con una tasa de acierto de aproximadamente el 50% en 12 objetivos frente a una norma del 10 al 15%, Fable 5.1 creó un mapa de elevación de Venus con una resolución de 2 a 3 km y núcleos de GPU personalizados aceleraron siete modelos genómicos de código abierto hasta 2,5 veces.