CourionAI
FR
Newsletter
← Glossaire Terme

Humanity's Last Exam

Un benchmark volontairement extrêmement difficile avec des questions d'experts provenant de nombreux domaines spécialisés.

Le dernier examen de l’humanité présente des questions posées par des experts dans des dizaines de disciplines sélectionnées si difficiles que les top models se trompent pour la plupart. Cela est dû au fait que les anciens benchmarks ne montraient pratiquement aucune différence à des valeurs supérieures à 90 %.

À la mi-2026, il y a encore environ 30 pour cent de modèles solides. C’est exactement ce qui est prévu : l’écart restant est mesuré. Comme tout benchmark individuel, HLE ne mesure qu’un éventail restreint de compétences et ne constitue pas un score d’intelligence général.