Chaîne de pensée
Le raisonnement étape par étape qu'un modèle rédige avant de donner sa réponse finale.
Posez une question difficile à un modèle et il s’en sort souvent mieux s’il déroule d’abord le problème par écrit, étape par étape, avant de s’engager sur une réponse. Ce cheminement écrit s’appelle la chaîne de pensée. Les modèles de raisonnement le font par défaut et peuvent y passer un long moment. Certains produits le masquent, d’autres l’affichent, d’autres encore en montrent un résumé, ce qui explique qu’un même modèle paraisse bavard dans une application et laconique dans une autre.
La chaîne de pensée sert à autre chose qu’à la justesse. Comme c’est du texte, elle se lit, et les équipes de sécurité la surveillent de plus en plus pour repérer un modèle qui part où il ne devrait pas et interrompre l’exécution automatiquement. Une réserve utile: le raisonnement écrit n’est pas la transcription garantie de ce que le modèle a réellement fait en interne. C’est un indice solide, pas un aveu.
-
OpenAI publie l'histoire complète de la façon dont ses agents ont piraté Hugging Face
-
Des chercheurs ont trouvé un moyen de lire les pensées cachées de Claude, ChatGPT et Gemini
-
OpenAI affirme que son prochain modèle pourrait atteindre le niveau de cyber-risque le plus élevé et a suspendu une partie du travail