Leitfaden
Eine unabhängige gemeinnützige Organisation, die KI-Unternehmen danach bewertet, wie gut sie die von ihnen intern betriebenen KI-Systeme kontrollieren.
Guidelight wurde von Page Hedley und Steven Adler, beide ehemalige Sicherheitsleiter bei OpenAI, mit dem Ziel gegründet, etwas zu tun, was niemand tat: zu überprüfen, ob KI-Labore ihr eigenes Sicherheitsdenken auf die Modelle anwenden, die sie intern verwenden. In der ersten Bewertung, die im August 2026 veröffentlicht wurde, wurden Anthropic, OpenAI, Google, xAI und Meta anhand von sechs grundlegenden Praktiken bewertet, darunter die Protokollierung der Aktivitäten interner Systeme, die Eingrenzung riskanter Aktionen hinter die Überprüfung und die Einrichtung eines Notstopps.
Niemand hat bestanden. Anthropic und OpenAI führten mit einem C-Plus, Google erhielt ein D-Plus, xAI ein D-Minus und Meta ein F. Die Bewertung stützt sich nur auf öffentliche Dokumente wie Systemkarten und Sicherheitsberichte, was sowohl ihre Schwäche als auch ihr Sinn ist: Sie belohnt Unternehmen, die veröffentlichen, und Guidelight möchte, dass das Veröffentlichen so normal wird, dass eine externe Prüfung überhaupt möglich ist.
-
Niemand hat bestanden: Das erste Zeugnis darüber, wie KI-Labore ihre eigenen Systeme überwachen
-
OpenAIs neue Transkriptionsmodelle sind schneller und 25 Prozent günstiger – aber nicht am genauesten
-
1.200 Beschäftigte aus KI-Laboren fordern in Washington eine Bremse, die noch niemand bauen kann
-
So beantwortet ein 100-seitiges PDF deine Fragen, und so prüfst du, ob die Antworten erfunden sind
-
OpenAIs neuer Prompting-Leitfaden: Nicht zerdenken, einfach das Ergebnis beschreiben
-
Ein PC-Klassiker von 2003 auf dem iPhone: KI portierte Command & Conquer an einem Wochenende auf iOS
-
Anthropics eigene Entwickler sagen: Bessere KI-Ergebnisse beginnen bei deinen blinden Flecken, nicht bei längeren Prompts