Simon Willison
Ein Programmierer und Autor, dessen Blog zu den verlässlichsten unabhängigen Quellen darüber gehört, was KI-Modelle können und wo ihre Grenzen liegen.
Simon Willison entwickelte das Webframework Django mit und verbringt heute einen großen Teil seiner Zeit damit, KI-Modelle öffentlich zu testen. Sein Blog ist ein fortlaufendes Protokoll darüber, was er ausprobiert hat, was funktionierte, was scheiterte und was es kostete. Das macht ihn wesentlich nützlicher als die meisten Ankündigungen von Anbietern.
Er erfand außerdem den Pelikan-Test, eine informelle Prüfung, bei der ein Modell das Bild eines Pelikans auf einem Fahrrad zeichnen soll. Das Motiv ist bewusst absurd gewählt. Dadurch existiert keine fertige Zeichnung, die das Modell kopieren könnte, und es muss die Szene selbst zusammensetzen. Der Test wurde zu einem Dauerwitz und zugleich zu einem wirklich praktischen schnellen Hinweis darauf, ob ein neues Modell versteht, wie Gegenstände räumlich zusammenpassen.
-
Forscher haben einen Weg gefunden, die verborgenen Gedanken von Claude, ChatGPT und Gemini zu lesen
-
Ein kostenloses Befehlszeilentool zeigt Ihnen jetzt, was ein Modell denkt, und kommuniziert mit fast jedem Modell
-
Karpathy verwandelte einen Absatz von Tolkien für zehn Dollar in eine 3D-Szene und nannte es einen Vibe Check
-
Anthropic: Claude entdeckt echte Schwächen in zwei Verschlüsselungsverfahren
-
Hugging Face rekonstruiert lückenlos, wie ein KI-Agent in seine Systeme eindrang