CourionAI
FR
Newsletter
← Toutes les actus
openai 2 min de lecture

Les modèles GPT-5.6 d’OpenAI seront lancés publiquement ce jeudi

Après plusieurs semaines d’accès restreint, les modèles GPT-5.6 Sol, Terra et Luna d’OpenAI seront proposés au public jeudi, avec de meilleurs résultats que Claude Mythos 5 dans les tests et des prix nettement inférieurs.

Illustration en risographie d’un soleil rayonnant, d’une petite planète et d’un croissant de lune se levant ensemble au-dessus d’une grille de départ ouverte

L’attente est terminée : la famille GPT-5.6 d’OpenAI, Sol, Terra et Luna, sera lancée publiquement ce jeudi. Les modèles avaient été dévoilés fin juin, mais leur accès était initialement réservé à certains partenaires pendant que le Center for AI Standards and Innovation (CAISI) du gouvernement américain menait des tests de sécurité supplémentaires. D’après Axios, le département du Commerce des États-Unis a désormais autorisé leur lancement public.

Les chiffres communiqués par OpenAI méritent le détour. Sur TerminalBench 2.1, un test qui mesure la capacité d’un modèle à effectuer un véritable travail de programmation dans un terminal, l’environnement en ligne de commande utilisé par les développeurs, GPT-5.6 Sol Ultra a obtenu 91,9 % et la version standard Sol 88,8 %. Tous deux devancent de peu Claude Mythos 5 d’Anthropic, qui atteint 88,0 %. Gemini 3.1 Pro Preview de Google reste derrière avec 70,7 %. Pour les tâches de cybersécurité, Sol aurait égalé Mythos 5 tout en n’utilisant qu’un tiers des tokens, les tokens étant les petits fragments de texte qu’un modèle lit et écrit, et qui servent aussi de base à la facturation.

Ce dernier point compte davantage que la bataille des scores. Sol coûte 5 dollars par million de tokens en entrée et 30 dollars par million de tokens en sortie. Fable 5 d’Anthropic est presque deux fois plus cher, à 10 et 50 dollars, et aurait en outre tendance à consommer davantage de tokens pour une même tâche. Si ces promesses d’efficacité se confirment en pratique, l’écart de coût réel pourrait être encore plus important que ne le laisse penser la grille tarifaire.

Voici ce qui explique ce lancement inhabituel : GPT-5.6 est le premier grand modèle soumis à un examen gouvernemental avant d’être proposé au public. OpenAI a ouvertement critiqué ce blocage, estimant qu’il privait les développeurs des meilleurs outils. Le modèle le plus performant d’Anthropic a récemment suivi un processus similaire. Il n’existe toutefois toujours aucun ensemble de règles contraignantes précisant quand et comment ces examens doivent avoir lieu. Pour l’instant, les décisions se prennent au cas par cas, et c’est précisément ce qui irrite les laboratoires.

Ce que cela signifie pour vous : Si vous utilisez ChatGPT, attendez-vous à voir arriver les nouveaux modèles peu après jeudi, probablement avec des progrès sensibles en programmation et sur les tâches en plusieurs étapes. Si vous développez avec l’API, le prix est l’information principale : un modèle de pointe proposé à la moitié du tarif d’Anthropic exerce une véritable pression sur le marché, et cette pression sur les prix finit généralement par profiter aux utilisateurs. Une réserve s’impose toutefois : les résultats publiés au moment du lancement viennent de l’entreprise elle-même. Attendez des évaluations indépendantes avant de réorganiser votre boîte à outils.

Sources

Sources: https://openai.com/index/previewing-gpt-5-6-sol

Article suivant

Microsoft remplace discrètement OpenAI et Anthropic dans Copilot pour réduire ses coûts

Les modèles MAI conçus par Microsoft remplacent ceux d’OpenAI et d’Anthropic dans Excel et Outlook, les clients risquent d’obtenir une IA moins performante pour le même prix d’abonnement.

Illustration en risographie d’un convoyeur qui remplace un grand moteur ouvragé par un modèle plus petit et plus simple, tandis que des pièces tombent dans un bocal