CourionAI
FR
Newsletter
← Toutes les actus
openai 3 min de lecture

OpenAI déclare que ses agents de codage fonctionnent désormais trois jours pour chaque journée humaine

OpenAI a publié des chiffres internes montrant que son organisme de recherche utilise 3,1 jours de travail d'agent de codage pour chaque journée de travail humaine, et affirme avoir atteint son objectif d'un stagiaire de recherche automatisé d'ici septembre.

Trois grandes lampes de bureau inclinées penchées sur une table à dessin vide, avec une seule lampe beaucoup plus petite à côté d'elles

OpenAI a publié hier un ensemble de chiffres internes sur la part de ses propres recherches qui sont désormais effectuées par des agents d’IA, et le chiffre principal est inhabituel par sa spécificité : 3,1 jours de travail d’agent d’effort de codage pour chaque journée de travail humain dans son organisation de recherche. L’entreprise affirme avoir atteint son objectif déclaré de recruter un « stagiaire en recherche automatisée » d’ici septembre 2026.

La métrique mérite un petit déballage, car elle fait beaucoup de travail. OpenAI a pris la durée d’exécution totale de ses agents de codage, l’a convertie en journée de travail standard de huit heures et l’a comparée au travail humain. Avant juin 2026, la durée d’exécution combinée des agents était inférieure au nombre total d’heures humaines. À la mi-août, il était une heure moins trois. Le temps d’exécution n’est pas une sortie, et un agent peut passer huit heures à tourner en rond, donc cela mesure l’effort appliqué plutôt que les problèmes résolus. OpenAI rapporte également que ses plus gros utilisateurs internes dépensent plus de 7 000 $ par jour en jetons, ce qui donne une idée de l’ampleur de cette opération. L’entreprise définit soigneusement « stagiaire de recherche » : un système qui exécute des tâches bien définies sous direction humaine, y compris celles qui prendraient quelques jours à un chercheur qualifié. Ce n’est pas un scientifique qui choisit son propre agenda. OpenAI affirme cibler un chercheur en IA véritablement automatisé d’ici mars 2028.

Pourquoi publier ceci. Il s’agit en partie d’un signal de recrutement et d’investisseurs, et en partie d’une réponse à une question que les gens ne cessent de poser aux laboratoires : si ces outils sont aussi bons que vous le dites, les utilisez-vous vous-mêmes ? C’est la première fois qu’un laboratoire pionnier met sur la table un ratio interne concret plutôt que de faire signe à la productivité. Traitez-le comme une auto-évaluation, parce que c’est ce dont il s’agit et parce que les « jours de travail de l’agent » sont une métrique qu’OpenAI a inventée et définie. Néanmoins, l’affirmation sous-jacente est vérifiable d’une manière plus lente : si la recherche triple réellement, cela devrait se refléter dans la cadence d’expédition, et les six dernières semaines ont été inhabituellement chargées dans l’ensemble du secteur.

Ce que cela signifie pour vous. Si vous écrivez du code, la leçon pratique n’est pas le rapport mais la forme du travail. OpenAI décrit des agents gérant des tâches limitées avec une définition claire de ce qui est fait, puis rendant les résultats à un humain pour qu’il les juge. Il s’agit d’un flux de travail que vous pouvez copier aujourd’hui avec les outils dont vous disposez déjà, et c’est bien plus productif que de demander à un modèle de faire quelque chose de vague. Si vous n’écrivez pas de code, ce qui est intéressant, c’est ce que “stagiaire” implique : supervisé, délimité et révisé. Tous ceux qui expérimentent les agents au travail convergent vers la même forme, ce qui est un véritable constat même si le numéro qui y est attaché provient d’une entreprise manifestement intéressée par la réponse.

Sources

Sources: https://openai.com/index/research-acceleration-view-inside-openai/

Article suivant

Le scientifique en chef d'OpenAI déclare qu'aucun laboratoire n'a suffisamment résolu l'alignement pour continuer aussi vite

Jakub Pachocki a publié un essai intitulé An Alien Mind le 6 septembre, affirmant qu'aucun laboratoire n'a suffisamment résolu l'alignement et la surveillance pour continuer à évoluer à la vitesse maximale, et qu'il s'attend à des ralentissements volontaires.

Un cadran de compteur de vitesse surdimensionné dessiné sous forme d'anneaux concentriques, son aiguille étant ramenée vers l'extrémité inférieure de l'échelle.