Anthropic's Fable 5.1 costa lo stesso, ad eccezione della parte che gli agenti utilizzano maggiormente
Claude Fable 5.1 è stato lanciato il 1° settembre con prezzi invariati a 10 e 50 dollari per milione di token, ma le letture della cache sono scese del 75% a 0,25 dollari. Anthropic afferma che sul lavoro tipico si risparmia circa il 25%.
Anthropic ha rilasciato Claude Fable 5.1 all’inizio della scorsa settimana, insieme a un gemello limitato chiamato Mythos 5.1. I prezzi principali non sono cambiati: 10 dollari per milione di token di input e 50 dollari per milione di token di output, lo stesso di Fable 5. La modifica è sepolta una riga più in basso e per chiunque gestisca agenti è la cifra più importante. Le letture della cache sono scese da 1 a 0,25 dollari per milione di token, con un taglio del 75%.
La memorizzazione nella cache merita una frase di spiegazione perché è il tipo di sistema idraulico che non fa mai notizia e decide tranquillamente il tuo conto. Quando invii a un modello lo stesso blocco di testo più e più volte, ad esempio un lungo prompt di sistema, una base di codice o un documento su cui continui a porre domande, il fornitore può archiviare la versione elaborata e addebitarti una tariffa ridotta per rileggerla invece di elaborarla ogni volta. Anthropic stima che il taglio consenta di risparmiare circa il 25% sui carichi di lavoro ordinari e fino al 45% su quelli fortemente agenti, dove un modello ripete lo stesso contesto decine di volte in una singola attività. Anthropic riporta che Fable 5.1 ha ottenuto un punteggio di 52,6 su Terminal-Bench-Science contro il 24,7 di Fable 5, anche se si tratta di una cifra auto-riferita e vale la pena trattarla come tale finché non compaiono numeri indipendenti.
Mythos 5.1 è lo stesso modello sottostante con meno restrizioni, disponibile attraverso programmi di accesso controllato alle organizzazioni di sicurezza informatica e di scienze della vita che necessitano di capacità che le garanzie di produzione normalmente bloccano. Questo è ora il terzo laboratorio in una settimana a spedire questa esatta struttura.
Perché la cache e non il prezzo adesivo. Ridurre la tariffa principale è una mossa forte e invita a un confronto immediato dei prezzi con ogni rivale. Ridurre la velocità della cache è più silenzioso e si rivolge a un cliente specifico: quello che esegue lunghi lavori autonomi, dove lo stesso contesto viene riletto centinaia di volte e le letture della cache dominano la fattura. Questo è il cliente che Anthropic desidera di più, perché il lavoro di codifica degli agenti è complicato ed è dove Claude è stato più forte. Letta come una mossa commerciale, questa è Anthropic che rende il suo conto più economico esattamente dove sta già vincendo, senza perdere margine sul traffico di chat ordinario.
Cosa significa per te. Se parli con Claude tramite l’app, niente di tutto questo ti toccherà. Se paghi per token, controlla se la tua configurazione utilizza effettivamente la memorizzazione nella cache dei prompt, perché un numero sorprendente non lo fa, e attivarla di solito è una piccola modifica del codice per un grande risparmio. Se esegui agenti di codifica che macinano ripetutamente lo stesso repository, questa è la versione per cui vale la pena leggere la pagina dei prezzi. E un’abitudine generale: quando un laboratorio dice “stesso prezzo”, guarda la riga della cache, la riga del lotto e la data di scadenza su qualsiasi tariffa di lancio. È qui che si sono mossi i numeri reali quest’anno.
Fonti
Gemini 3.8 Flash di Google mantiene il vecchio prezzo e porta un Cyber Twin
Google DeepMind ha rilasciato Gemini 3.8 Flash il 2 settembre a 0,75 dollari per milione di token di input, invariato rispetto a 3.7 Flash. Una variante informatica separata per l'individuazione e l'applicazione di patch alle vulnerabilità è riservata solo ai difensori controllati.