CourionAI
IT
Newsletter
← Tutte le notizie
anthropic 2 min di lettura

La risposta di Anthropic al prezzo di Fable 5: lasciare che gestisca modelli più economici

Due schemi ufficiali, Advisor e Orchestrator, raggiungono fino al 96% delle prestazioni di Fable 5 a circa metà del costo abbinandolo a Sonnet 5.

Illustrazione in stile risograph di un grande robot direttore d'orchestra che coordina tre piccoli robot al lavoro alle scrivanie

Claude Fable 5 è il modello più potente venduto da Anthropic, nonché uno dei più costosi: 10 dollari per milione di token in ingresso e 50 dollari per milione di token in uscita. Il nuovo consiglio di Anthropic agli sviluppatori è di non lasciargli fare tutto il lavoro. Negli esempi ufficiali del cookbook e nella documentazione, l’azienda raccomanda ora di usare Fable 5 come una sorta di collega senior che guida i modelli più economici, invece di fargli scrivere personalmente ogni riga.

Due schemi permettono di ottenere il risultato. Nel modello «Advisor», il più piccolo Sonnet 5 svolge il lavoro vero e proprio e chiama Fable 5 soltanto quando si blocca, all’incirca una volta per attività secondo Anthropic. Su SWE-bench Pro, un benchmark basato su veri problemi di ingegneria del software, questa combinazione raggiunge circa il 92% delle prestazioni di Fable 5 usato da solo al 63% del costo. Il secondo schema capovolge la gerarchia: Fable 5 agisce da «Orchestrator», prepara il piano e delega le singole parti a più istanze operative di Sonnet 5. Su BrowseComp, un benchmark per la ricerca sul web, questa configurazione offre il 96% delle prestazioni al 46% del costo. Entrambi funzionano tramite Claude Managed Agents, con ciascun sotto-agente che conserva una propria cache di memoria per evitare di pagare più volte lo stesso contesto.

Ecco cosa c’è dietro: una pressione sui prezzi che arriva da ogni direzione. Modelli aperti cinesi come GLM 5.2 costano molto meno dei concorrenti occidentali, il nuovissimo Grok 4.5 di xAI costa un quinto di Fable 5 e GPT-5.6 di OpenAI debutta a un prezzo inferiore e, a quanto risulta, è anche più efficiente nell’uso dei token. La risposta di Anthropic non è un taglio dei prezzi, ma un manuale d’uso per spendere meno. L’interpretazione più onesta è che «pianifica in grande, esegui in piccolo» sia davvero un buon consiglio ingegneristico, già adottato informalmente da tempo dai team. Ora è ufficiale, documentato e misurato nei benchmark.

Cosa significa per te: se usi Claude tramite l’app di chat, non cambia nulla: questa soluzione è destinata a chi sviluppa con le API. Se è il tuo caso, vale la pena adottare lo schema anche al di fuori di Claude: usa un modello costoso per il giudizio e la pianificazione e modelli economici per l’esecuzione. La stessa logica si applica all’offerta di qualsiasi fornitore. E se osservi semplicemente il settore da bordo campo, c’è una conclusione interessante sulla direzione dell’IA: probabilmente il futuro non sarà un unico modello gigantesco che fa tutto, bensì squadre di modelli, uno intelligente che gestisce e altri più economici che eseguono. Nel bene e nel male, è un organigramma molto familiare.

Fonti

Fonti: https://platform.claude.com/docs/en/agents-and-tools/tool-use/advisor-tool

Articolo successivo

Grok 4.5 arriva a un terzo del prezzo, e questo potrebbe contare più dei benchmark

Il nuovo modello di xAI resta indietro rispetto a Fable 5 e GPT-5.5 in alcuni test di programmazione, ma a 2 dollari per milione di token in ingresso costa meno di tutti i rivali della sua categoria. Il lancio nell'UE è previsto a metà luglio.

Illustrazione in stile risograph di un razzo con un enorme cartellino del prezzo che sale sopra un podio a grafico a barre