Anthropic lanzó Claude Fable 5.1 y Mythos 5.1 el 1 de septiembre, y el titular que circuló fue “aproximadamente un 25% más barato”. La tabla de precios del anuncio dice algo más limitado: 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida, ambos sin cambios respecto a Fable 5. Lo que sí cambió son las lecturas de caché, que bajan un 75% hasta 0,25 dólares por millón.

Qué falla en el enfoque habitual

Un descuento que vive por completo en las lecturas de caché solo existe para cargas de trabajo que realmente reutilizan un prefijo almacenado en caché. Una llamada única sin acierto de caché cuesta exactamente lo mismo que la semana pasada. La cifra de “hasta aproximadamente un 45%” citada para cargas de trabajo agentivas es el mejor escenario, no el habitual, y lo es precisamente porque los agentes de larga duración vuelven a leer repetidamente el mismo contexto. Esto no es un recorte del precio de la inteligencia; es un recorte del precio de la repetición.

Dos nombres, un modelo

Lo segundo que simplifica la cobertura es que Fable 5.1 y Mythos 5.1 son el mismo modelo subyacente con distintos niveles de salvaguarda, con Mythos limitado a entidades de EE. UU. en programas de acceso de confianza. En Terminal-Bench 4.0, la pareja obtiene 55,8% y 60,9%, frente al 42,0% de Mythos 5, el 52,3% de Opus 5 y el 37,3% de GPT-5.6 Sol. Leído correctamente, la brecha de 5,1 puntos entre ambos no es en absoluto una diferencia de capacidad, sino lo que hacen los mismos pesos con menos rechazos. Es una de las pocas cifras públicas que pone precio a una capa de seguridad.

El benchmark con el margen de error que nadie cita

El resultado estrella es Terminal-Bench-Science 0.1, donde Fable 5.1 alcanza 52,6% frente al 24,7% de Fable 5, el 29,0% de Opus 5 y el 22,4% de GPT-5.6 Sol. Anthropic imprime junto a él un margen de error declarado de ±3,5 a 4,5 puntos por modelo. En otros apartados: GDPval-AA v2 en 1853 (Fable 5: 1723), OSWorld 2.0 en 77,9% parcial y 41,7% estricto, Humanity's Last Exam en 60,9% sin herramientas y AutomationBench en 31,4%.

Menos intervenciones y una norma cibernética más estrecha

Anthropic afirma que las salvaguardas biológicas ahora se activan un 85% menos en solicitudes benignas y que las salvaguardas de ciberseguridad producen alrededor de un 60% menos de intervenciones por sesión. La línea de política se movió con ello: Fable 5.1 puede usarse para descubrir vulnerabilidades, pero no para desarrollar exploits para ellas.