En resumen
- Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el 1 de septiembre, obteniendo un 52.6% en Terminal-Bench-Science 0.1 frente al 24.7% de Fable 5, y un 55.8% en Terminal-Bench 4.0 frente al 42.0%.
- Las lecturas de caché ahora cuestan un 75% menos, reduciendo los costos típicos de carga de trabajo en aproximadamente un 25% y las cargas de trabajo altamente agénticas hasta en un 45%, con el precio base sin cambios en $10/$50 por millón de tokens.
- Fable 5.1 no está incluido en los planes Pro ni en los asientos estándar de Team, que lo ejecutan con créditos de uso; los asientos Max y premium de Team o Enterprise lo incluyen hasta el 50% de los límites semanales.
Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el martes, su primera actualización a la línea de modelos Mythos desde que Fable 5 se lanzó el 9 de junio.
La compañía afirma que los nuevos modelos de IA son los "más avanzados para codificación y trabajo de conocimiento", y llega tres meses después de un ciclo de lanzamiento que ya ha incluido un cierre de 18 días por controles de exportación, una disputa de precios a mediados de verano sobre el acceso por suscripción, y un lanzamiento en julio de Claude Opus 5 que socavó a Fable 5 en precio.

Fable 5.1 y Mythos 5.1 son, según Anthropic, el mismo modelo subyacente con diferentes filtros de seguridad añadidos. Fable 5.1 está disponible generalmente para cualquier persona con una cuenta de Claude. Mythos 5.1 permanece restringido a profesionales verificados de ciberseguridad y ciencias de la vida a través del Programa de Verificación Cibernética y el Programa de Verificación de Ciencias de la Vida de Anthropic, sucesores de la vía de acceso del Proyecto Glasswing que limitaba Mythos 5.
Qué miden realmente los puntos de referencia
El número principal de Anthropic proviene de Terminal-Bench-Science 0.1, un punto de referencia que prueba si un agente de IA puede llevar a cabo tareas de investigación científica dentro de un entorno de línea de comandos, puntuado como una tasa de aprobación.
Fable 5.1 alcanzó el 52.6% frente al 24.7% de Fable 5 y el 29.0% de Opus 5, más del doble que su predecesor.
Terminal-Bench 4.0 prueba la codificación agéntica realizada a través de una terminal: escribir, ejecutar y depurar código en sesiones de línea de comandos de múltiples pasos, puntuado como un porcentaje de tareas completadas correctamente. Fable 5.1 obtuvo un 55.8%, frente al 42.0% de Fable 5 y por delante del 52.3% de Opus 5.
Mythos 5.1, que se ejecuta con filtros de ciberseguridad más ligeros, obtuvo un 60.9% en la misma prueba; Anthropic dice que la brecha refleja tareas que sus salvaguardas interceptaron y redirigieron a Opus 4.8.

En el Examen Final de la Humanidad, una prueba de razonamiento multidisciplinario construida a partir de preguntas de nivel experto en docenas de campos académicos y calificada como tasa de aprobación, Fable 5.1 alcanzó el 60.9% sin herramientas externas y el 65.0% con ellas, ambos por delante de Opus 5, lo que demuestra que este es el modelo más avanzado de Anthropic para fines académicos.

Dónde supera a Opus 5, y dónde las matemáticas se vuelven más turbias
Opus 5 se lanzó en julio costando la mitad del precio por token de Fable 5, mientras superaba a Fable 5 en la mayoría de los principales puntos de referencia, haciendo efectivamente redundante al modelo insignia para la mayoría de los usuarios que pagan.
Fable 5.1 revierte eso: ahora supera a Opus 5 en todos los puntos de referencia que Anthropic publicó, incluidos aquellos en los que Opus 5 había superado previamente a Fable 5.
Pero Fable 5.1 todavía cuesta el doble por token que Opus 5: $10 de entrada y $50 de salida frente a los $5 y $25 de Opus 5. Los tokens son la cantidad básica de información que un modelo puede manejar (generalmente alrededor de dos tercios de una palabra promedio en inglés), y las empresas pagan por su uso porque los flujos de trabajo pesados suelen agotar rápidamente las cuotas establecidas en los planes de suscripción.
La propia propuesta de Anthropic para el modelo se apoya en los niveles de esfuerzo más que en las puntuaciones brutas: dice que ejecutar Fable 5.1 con un esfuerzo de razonamiento bajo o medio iguala o supera los antiguos resultados de Fable 5 a un costo mucho menor, mientras reserva los niveles de esfuerzo más altos para problemas que superan a todo lo demás.
Para el trabajo rutinario, ese argumento para omitir por completo Opus 5 se debilita cuanto más bajo es el nivel de esfuerzo.
El acceso sigue la misma división que se aplicó a Fable 5 después de meses de ajustes por parte de Anthropic. En los planes Pro y en los asientos estándar de Team o Enterprise, Fable 5.1 se extrae completamente de los créditos de uso de pago por uso facturados a la tarifa de API, ya que no forma parte de los límites semanales de esos planes. En los planes Max y en los asientos premium de Team o Enterprise, se incluye como parte estándar de la suscripción hasta el 50% del uso semanal.
Claude Fable 5.1 ya está disponible en la API de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry, bajo el ID de modelo "claude-fable-5-1".






