Regarder son propre modèle coûte désormais 20 % de plus à OpenAI, et il a suspendu une session de formation pour le faire
Selon OpenAI, la surveillance de la sécurité ajoute environ 20 % au calcul d'inférence surveillé. Il a suspendu l’apprentissage par renforcement pendant deux semaines et sa plus grande course aux frontières prévue est toujours suspendue.
OpenAI a publié un article le 18 août expliquant pourquoi il a ralenti. Deux événements se sont produits de manière rapprochée : l’incident de sécurité Hugging Face et la preuve préliminaire qu’Astra, un modèle à venir, pourrait franchir le seuil critique de cybersécurité dans le propre cadre de préparation de l’entreprise. En réponse, OpenAI a suspendu la formation d’apprentissage par renforcement sur ses derniers modèles pendant deux semaines, le temps de renforcer ses environnements de recherche, et affirme que sa plus grande série de formations de pointe planifiée reste suspendue pendant que des évaluations plus petites sont exécutées en premier.
Le nombre récupéré correspond au coût. OpenAI estime sa surcharge de surveillance à environ 20 % du calcul d’inférence surveillé, bien qu’il souligne que ce chiffre varie considérablement en fonction de la charge de travail. L’inférence, si le mot est nouveau, consiste simplement à exécuter un modèle pour produire une réponse, plutôt que de le former en premier lieu. Ainsi, pour cinq unités de calcul dépensées sur une charge de travail surveillée, une sixième est consacrée à sa surveillance. La société a déclaré à The Register qu’il s’agissait de dépenses de recherche internes et qu’elles ne seraient pas transmises directement aux clients.
Ce que cet argent achète est plus qu’un filtre sur la sortie. Les classificateurs inspectent l’activité interne du modèle à chaque token échantillonné et transmettent tout ce qui est étrange à des enquêteurs automatisés de plus en plus coûteux, qui examinent les actions des outils, le raisonnement visible et l’ensemble de la séquence de comportement en cas d’accès non autorisé, de vol de données, de destruction ou de tentatives de contournement des mesures de protection. L’objectif est une alerte dans les 30 minutes, et si les équipes sollicitées ne peuvent exclure une fausse alarme dans cette fenêtre, l’activité devrait s’arrêter. L’exigence couvre tous les apprentissages par renforcement et les évaluations utilisant des outils à la capacité GPT-5.6 Sol ou supérieure, et depuis le 7 août, toutes les inférences Astra avec des outils.
Voici la partie qu’il est facile de manquer. Il s’agit d’une entreprise qui affirme haut et fort que ses propres laboratoires constituent désormais une surface à risque. Le travail de sécurité décrit ne vise pas à protéger les utilisateurs du modèle, il s’agit de contenir le modèle à l’intérieur du bâtiment : des bacs à sable plus solides pour tout ce qui exécute du code généré par le modèle, une isolation du réseau afin qu’une charge de travail compromise ne puisse pas atteindre Internet, la suppression des services partagés et une équipe rouge automatisée qui utilise ses propres modèles pour attaquer continuellement ses propres limites. Il s’agit d’un organisme de recherche qui traite ses pôles de formation à peu près de la même manière qu’une banque traite une salle des marchés.
Ce que cela signifie pour vous : rien ne change dans votre fenêtre ChatGPT aujourd’hui, et aucun prix n’a changé. La raison pour laquelle il faut prêter attention est l’économie. La sécurité est généralement abordée comme une question politique, et ici elle apparaît comme un poste auquel est attaché un pourcentage, ce qui en fait un élément qui peut être réduit lorsque les marges se resserrent. Le Registre a soulevé exactement ce point : il est plus facile pour une entreprise privée d’absorber les coûts en interne que pour une entreprise publique, ce qu’il convient de rappeler à mesure qu’OpenAI s’oriente vers une cotation. Pour quiconque construit avec des agents, il y a un signal plus petit et plus pratique : le laboratoire le plus compétent dans le domaine a décidé que surveiller ce qu’un modèle utilisant un outil fait à chaque étape vaut un cinquième du calcul.
Sources
- OpenAI : stimuler le développement d’un modèle à l’ère des capacités cybercritiques
- The Register : les frais généraux d’OpenAI augmenteront de 20 % pour certaines charges de travail à mesure qu’il renforce la sécurité
- Help Net Security : OpenAI suspend une importante formation en IA de pointe en raison des cyber-risques
Sources: https://openai.com/index/pacing-model-development-cyber-capabilities/
Donnez à un modèle frontière uniquement une bibliographie et demandez l’idée. Il y arrive 3 à 15 pour cent du temps
Un nouveau benchmark appelé Reconstruction supprime tout sauf la liste de références d'un article et demande aux modèles de récupérer ses conclusions principales. Sept modèles frontières ont obtenu des scores compris entre 3 et 15 pour cent. Un tournoi multi-agents a atteint 42.