Meta hört auf, Ingenieure danach zu bewerten, wie viel KI sie verwenden
Nachdem die Mitarbeiter in einer internen Token-Rangliste gegeneinander angetreten waren, teilte Meta den Ingenieuren mit, dass KI-Nutzungs-Dashboards und Token-Zählungen bei Leistungsüberprüfungen nicht mehr berücksichtigt werden. Die Episode hat jetzt einen Namen: tokenmaxxing.
Meta hat seinen Ingenieuren mitgeteilt, dass KI-Nutzungs-Dashboards und Token-Zählungen bei Leistungsüberprüfungen nicht mehr berücksichtigt werden. Die Anweisung kam in einem internen Memo der Führungskräfte Maher Saba und Santosh Janardhan, über das erstmals The Information berichtete. Vielmehr zähle, heißt es in dem Memo, die Qualität, Geschwindigkeit und Komplexität der Arbeit selbst.
Das ist eine Umkehrung. Meta hatte zuvor die Verwendung von KI zu einer Kernerwartung in Rezensionen gemacht, und das Vorhersehbare geschah. Ein Mitarbeiter hat im Intranet des Unternehmens eine interne Bestenliste mit dem Spitznamen Claudeonomics erstellt, in der mehr als 85.000 Mitarbeiter nach der Anzahl der verbrauchten Token eingestuft wurden. Token sind die Texteinheiten, die ein KI-Modell verarbeitet, und die Dinge, die Ihnen in Rechnung gestellt werden. Die Top 250 wurden aufgelistet. Der gemeldete Verbrauch erreichte in etwas mehr als 30 Tagen 73,7 Billionen Token. Die Mitarbeiter begannen, das Verhalten tokenmaxxing zu nennen: KI auf Dingen laufen zu lassen, die es nicht brauchten, und zwar schließlich, um einen Chart zu erklimmen. CTO Andrew Bosworth widersprach in seinem eigenen Memo und schrieb, dass niemand KI-Tools nur um ihrer Nutzung willen nutzen sollte und dass jede Bewegung kein Fortschritt sei. Der Gesetzentwurf war auch nicht theoretisch. Metas interne KI-Ausgaben gehen Berichten zufolge für 2026 in die Milliarden, weshalb Budgets und ein zentrales Kosten-Dashboard für 2027 geplant sind. Mittlerweile gibt das Unternehmen an, dass KI-Agenten bei 93 Prozent seiner Codeänderungen helfen, betont aber, dass die Einführung nicht das Ziel an sich sei.
Was steckt dahinter
Das ist Goodharts Gesetz mit neuem Anstrich: Wenn eine Maßnahme zum Ziel wird, ist sie keine gute Maßnahme mehr. Die Anzahl der Token lässt sich leicht protokollieren, weshalb sie genau aus diesem Grund ausgewählt wurden, und sie hat fast keinen Zusammenhang damit, ob die Arbeit gut war. Sie können eine Million Token für eine Aufgabe verbrennen, die ein Kollege mit einer Suche in zehn Minuten gelöst hat.
Das tiefere Problem besteht darin, dass die KI-Nutzung eine Eingabe und keine Ausgabe ist. Unternehmen greifen zu Input-Metriken, wenn der Output schwer zu messen ist und die Softwarequalität bekanntermaßen schwer zu messen ist. Meta hatte eine echte Frage, nämlich ob die Mitarbeiter wirklich hilfreiche Tools nutzen, und wählte die einzige Zahl aus, die diese Frage nicht beantworten konnte. Bemerkenswert ist, dass Meta keineswegs von der KI abweicht: 93 Prozent agentengestützter Codeänderungen sind eine sehr hohe Zahl. Es ist ein Rückzieher vom Zählen.
Was das für Sie bedeutet: Wenn Ihr Arbeitgeber damit begonnen hat, die KI-Nutzung zu verfolgen, ist dies ein nützlicher Präzedenzfall, auf den Sie hinweisen können, und zwar von einem Unternehmen, das sich intensiv mit der Technologie beschäftigt. Die ehrliche Version der Frage lautet nicht „Haben Sie das Tool verwendet“, sondern „Ist die Arbeit besser oder schneller geworden?“. Wenn Sie selbst KI nutzen, ist die Erkenntnis kleiner und persönlicher: Greifen Sie zu ihr, wenn sie Ihnen etwas Reales rettet, und überspringen Sie sie, wenn dies nicht der Fall ist. Niemand zählt mit, und wo sie waren, lief es schlecht.
Quellen
Microsoft hat eine Rekordzahl von 973 Sicherheitslücken gepatcht und eine KI hat einige davon gefunden
Der Patch-Dienstag im September ist der größte aller Zeiten: 973 Korrekturen, 113 kritische, zwei bereits angegriffene und drei Schwachstellen in Copilot-Produkten. Laut Microsoft hat ein Agenten-Scansystem dabei geholfen, einen Teil des Stapels aufzudecken.