Simon Willison
Un programmeur et auteur dont le blog constitue l’un des guides indépendants les plus fiables sur les capacités et les limites des modèles d’IA.
Simon Willison a participé à la création du framework web Django et consacre aujourd’hui une grande partie de son temps à tester publiquement des modèles d’IA. Son blog tient le registre de ses essais, de ce qui a fonctionné, de ce qui a échoué et de leur coût. Il est ainsi bien plus utile que la plupart des annonces de fournisseurs.
Il est aussi à l’origine du test du pélican, une épreuve informelle qui demande à un modèle de dessiner un pélican à vélo. Le sujet est volontairement absurde, afin qu’aucun dessin achevé n’existe dans les données et que le modèle doive composer la scène lui-même. Le test est devenu à la fois une plaisanterie récurrente et un moyen rapide réellement pratique d’observer si un nouveau modèle comprend comment les objets s’organisent dans l’espace.
-
Des chercheurs ont trouvé un moyen de lire les pensées cachées de Claude, ChatGPT et Gemini
-
Un outil de ligne de commande gratuit vous montre désormais ce que pense un modèle et communique avec presque tous les modèles
-
Karpathy a transformé un paragraphe de Tolkien en scène 3D pour dix dollars et a appelé cela un vibe check.
-
Selon Anthropic, Claude a découvert deux faiblesses inédites dans des algorithmes cryptographiques
-
Hugging Face publie la chronologie complète de l’intrusion menée par un agent d’IA