Anthropic ha rilasciato Claude Fable 5.1 e Mythos 5.1 il 1 settembre, e il numero che ha fatto il giro è stato “circa il 25% più economico”. La tabella dei prezzi nell’annuncio dice qualcosa di più circoscritto: 10 dollari per milione di token di input e 50 dollari per milione di token di output, entrambi invariati rispetto a Fable 5. Ciò che è cambiato sono i cache read, in calo del 75% a 0,25 dollari per milione.
Ciò che la cornice più comune sbaglia
Uno sconto che vive interamente nei cache read esiste solo per i carichi di lavoro che riutilizzano davvero un prefisso in cache. Una chiamata una tantum senza cache hit costa esattamente quanto costava la scorsa settimana. La cifra “fino a circa il 45%” citata per i carichi di lavoro agentici è lo scenario migliore, non quello tipico, ed è lo scenario migliore proprio perché gli agenti di lunga durata rileggono ripetutamente lo stesso contesto. Non si tratta di un taglio al prezzo dell’intelligenza; è un taglio al prezzo della ripetizione.
Due nomi, un modello
La seconda semplificazione che la copertura compie è che Fable 5.1 e Mythos 5.1 sono lo stesso modello sottostante a due diversi livelli di protezione, con Mythos riservato a entità statunitensi in programmi di trusted access. Su Terminal-Bench 4.0 la coppia ottiene 55,8% e 60,9%, contro il 42,0% di Mythos 5, il 52,3% di Opus 5 e il 37,3% di GPT-5.6 Sol. Letto correttamente, il divario di 5,1 punti tra i due non è affatto una differenza di capacità — è ciò che gli stessi pesi fanno con meno rifiuti. È uno dei pochi numeri pubblici che attribuisce un prezzo a uno strato di sicurezza.
Il benchmark con il margine d’errore che nessuno cita
Il risultato di punta è Terminal-Bench-Science 0.1, dove Fable 5.1 raggiunge 52,6% contro il 24,7% di Fable 5, il 29,0% di Opus 5 e il 22,4% di GPT-5.6 Sol. Anthropic indica accanto un margine d’errore dichiarato di ±3,5-4,5 punti per modello. Altrove: GDPval-AA v2 a 1853 (Fable 5: 1723), OSWorld 2.0 al 77,9% parziale e 41,7% rigoroso, Humanity's Last Exam al 60,9% senza strumenti e AutomationBench al 31,4%.
Meno interventi e una regola cyber più stretta
Anthropic afferma che le protezioni biologiche ora si attivano l’85% in meno sulle richieste benigne e che le protezioni per la cybersecurity producono circa il 60% in meno di interventi per sessione. La linea di policy si è mossa con loro: Fable 5.1 può essere usato per scoprire vulnerabilità, ma non per sviluppare exploit per esse.
