CourionAI
FR
Newsletter
← Toutes les actus
anthropic 3 min de lecture

La réponse d’Anthropic au prix de Fable 5 : lui confier la gestion de modèles moins chers

Deux méthodes officielles, Advisor et Orchestrator, offrent jusqu’à 96 % des performances de Fable 5 pour environ la moitié du coût, en l’associant à Sonnet 5.

Illustration en risographie d’un grand robot chef d’orchestre dirigeant trois petits robots au travail derrière des bureaux

Claude Fable 5 est le modèle le plus puissant commercialisé par Anthropic, et l’un des plus chers, à 10 dollars par million de jetons d’entrée et 50 dollars par million de jetons de sortie. Le nouveau conseil d’Anthropic aux développeurs : ne le laissez pas faire tout le travail. Dans des exemples de recettes et une documentation officielles, l’entreprise recommande désormais d’utiliser Fable 5 comme une sorte de collègue expérimenté qui guide des modèles moins coûteux, plutôt que de lui faire écrire lui-même chaque ligne.

Deux méthodes permettent d’y parvenir. Dans le schéma « Advisor », le petit Sonnet 5 effectue le travail et n’appelle Fable 5 qu’en cas de blocage, environ une fois par tâche, selon Anthropic. Sur SWE-bench Pro, une évaluation fondée sur de véritables problèmes d’ingénierie logicielle, cette combinaison atteint environ 92 % des performances de Fable 5 seul, pour 63 % du coût. Le second schéma inverse la hiérarchie : Fable 5 joue le rôle d’« Orchestrator », établit le plan et délègue les différentes parties à plusieurs agents Sonnet 5. Sur BrowseComp, une évaluation de recherche sur le web, cette configuration offre 96 % des performances pour 46 % du coût. Les deux fonctionnent avec Claude Managed Agents, chaque sous-agent conservant son propre cache mémoire afin d’éviter de payer plusieurs fois pour le même contexte.

Voici ce qui se cache derrière cette approche : une pression sur les prix venue de toutes parts. Les modèles chinois ouverts comme GLM 5.2 cassent radicalement les prix occidentaux, le tout nouveau Grok 4.5 de xAI coûte cinq fois moins cher que Fable 5, et GPT-5.6 d’OpenAI arrive à un tarif inférieur tout en étant, selon certaines informations, plus économe en jetons. La riposte d’Anthropic ne consiste pas à baisser ses prix, mais à fournir un mode d’emploi pour dépenser moins. L’interprétation honnête : « planifier avec un grand modèle, exécuter avec de petits » est un véritable bon conseil d’ingénierie que les équipes appliquent de manière informelle depuis quelque temps. Il est désormais officiel, documenté et mesuré.

Ce que cela signifie pour vous : Si vous utilisez Claude dans l’application de chat, rien ne change, cette nouveauté concerne les personnes qui développent avec l’API. Si c’est votre cas, cette méthode mérite d’être reprise même en dehors de Claude : utilisez un modèle coûteux pour le jugement et la planification, puis des modèles bon marché pour l’exécution. La même logique vaut pour la gamme de n’importe quel fournisseur. Et si vous observez simplement le secteur, retenez cette idée sur la direction prise par l’IA : l’avenir ne sera probablement pas un modèle géant qui fait tout, mais des équipes de modèles, un modèle intelligent qui dirige, des modèles moins chers qui exécutent, ce qui ressemble, pour le meilleur ou pour le pire, à un organigramme très familier.

Sources

Sources: https://platform.claude.com/docs/en/agents-and-tools/tool-use/advisor-tool

Article suivant

Grok 4.5 arrive pour un tiers du prix, et cela pourrait compter davantage que les évaluations

Le nouveau modèle de xAI reste derrière Fable 5 et GPT-5.5 dans certains tests de programmation, mais à 2 dollars par million de jetons d’entrée, il est moins cher que tous les modèles de sa catégorie. Son lancement dans l’UE est attendu à la mi-juillet.

Illustration en risographie d’une fusée munie d’une immense étiquette de prix s’élevant au-dessus d’un podium en diagramme à barres