GPT-5.6 Sol égale presque le meilleur modèle d’IA, pour un tiers du prix
Des évaluations indépendantes placent le nouveau modèle phare d’OpenAI un point derrière Claude Fable 5, alors que chaque tâche coûte environ trois fois moins cher. La guerre des prix de l’IA a gagné le très haut de gamme.
Maintenant que GPT-5.6 est accessible au public, les premiers chiffres indépendants sont disponibles, et ils expliquent pourquoi ce lancement inquiète la concurrence. Selon Artificial Analysis, une plateforme qui agrège de nombreux tests d’IA en un seul score, GPT-5.6 Sol obtient 59 points sur son indice d’intelligence, à seulement un point de Claude Fable 5, actuel leader avec 60 points. Le problème pour Anthropic : Sol y parvient pour environ 1,04 dollar par tâche, soit à peu près un tiers des 2,75 dollars de Fable 5.
Dans le nouvel indice Coding Agent de la plateforme, qui mesure la capacité des modèles à réaliser de véritables tâches de programmation à l’aide d’outils, Sol prend même la première place avec 80 points lorsqu’il fonctionne dans l’environnement Codex d’OpenAI, devant Fable 5 dans Claude Code, qui en obtient 77. Les petites variantes de GPT-5.6 sont encore moins chères : Terra revient à environ 0,55 dollar par tâche, et Luna à 0,21 dollar. Les tarifs officiels par million de jetons s’établissent à 5 dollars en entrée et 30 dollars en sortie pour Sol, 2,50 et 15 dollars pour Terra, puis 1 et 6 dollars pour Luna. Sam Altman affirme également que Sol utilise jusqu’à 54 % de jetons de sortie en moins pour les tâches de programmation agentique, une déclaration rapportée et venue du PDG lui-même, qu’il convient donc de considérer comme un argument marketing tant qu’elle n’aura pas été confirmée indépendamment.
Que se cache-t-il derrière ces chiffres ? Le « coût par tâche » devient plus important que le score brut aux tests. Un modèle qui obtient un résultat légèrement inférieur, mais consomme beaucoup moins de jetons, ces petits fragments de texte que facturent les entreprises d’IA, peut revenir nettement moins cher dans la pratique. C’est la pression qui s’exerce actuellement sur Anthropic : Fable 5 reste en tête pour l’intelligence globale, mais la nouvelle API de Meta, Grok 4.5 de xAI et les modèles chinois open source font tous baisser les prix. OpenAI offre désormais une qualité de tout premier plan pour une fraction du coût. Gardons toutefois des attentes réalistes : les indices agrégés masquent beaucoup de nuances, et un point d’écart sur une échelle de 100 dit peu de choses sur le modèle qui conviendra le mieux à votre travail précis.
Ce que cela signifie pour vous : Si vous souscrivez à une formule de chat, rien ne change aujourd’hui, il s’agit de tarifs d’API destinés aux développeurs. Mais leurs effets se répercutent : des jetons moins chers permettent aux fournisseurs d’inclure davantage d’utilisation dans un abonnement, et réduisent le coût de fonctionnement des outils construits sur ces modèles. Si vous choisissez un modèle pour un projet, la conclusion pratique est de ne plus demander « quel est le modèle le plus intelligent ? », mais « lequel est suffisamment intelligent pour ce travail, au coût le plus bas ? »l’écart au sommet est devenu aussi mince.
Sources
Sources: https://x.com/ArtificialAnlys/status/2075268970492657905
Meta entre dans la guerre des prix de l’IA avec Muse Spark 1.1 et sa première API pour développeurs
Le nouveau modèle de raisonnement de Meta s’accompagne de la première API publique de l’entreprise pour les développeurs, à 4,25 dollars par million de jetons de sortie, elle est moins chère que celles de tous ses grands concurrents américains.