Meta smette di valutare gli ingegneri in base alla quantità di intelligenza artificiale che utilizzano
Dopo che il personale si è confrontato su una classifica interna dei token, Meta ha detto agli ingegneri che i dashboard sull'utilizzo dell'intelligenza artificiale e il conteggio dei token non conteranno più nelle revisioni delle prestazioni. L'episodio ora ha un nome: tokenmaxxing.
Meta ha detto ai suoi ingegneri che i dashboard di utilizzo dell’intelligenza artificiale e il conteggio dei token non verranno più presi in considerazione nelle revisioni delle prestazioni. L’istruzione è arrivata in una nota interna dei dirigenti Maher Saba e Santosh Janardhan, riportata per la prima volta da The Information. Ciò che conta invece, si legge nella nota, è la qualità, la velocità e la complessità del lavoro stesso.
Questa è un’inversione. Meta aveva precedentemente fatto sì che l’intelligenza artificiale utilizzasse un’aspettativa fondamentale nelle recensioni e la cosa prevedibile è accaduta. Un dipendente ha creato una classifica interna sull’intranet aziendale, soprannominata Claudeonomics, che ha classificato più di 85.000 dipendenti in base al numero di token bruciati, i token sono le unità di testo elaborate da un modello di intelligenza artificiale e ciò per cui ti vengono fatturati. Sono stati elencati i primi 250. Il consumo segnalato ha raggiunto i 73,7 trilioni di token in poco più di 30 giorni. Il personale ha iniziato a chiamare questo comportamento tokenmaxxing: eseguire l’intelligenza artificiale su cose che non ne avevano bisogno, alla fine, per scalare una classifica. Il CTO Andrew Bosworth ha rilanciato nella sua nota, scrivendo che nessuno dovrebbe usare gli strumenti di intelligenza artificiale solo per il gusto di usarli e che ogni movimento non è progresso. Nemmeno il disegno di legge era teorico. Secondo quanto riferito, la spesa interna per l’intelligenza artificiale di Meta si sta dirigendo verso i miliardi per il 2026, motivo per cui sono previsti budget e un pannello di controllo centrale dei costi per il 2027. Nel frattempo la società afferma che gli agenti AI aiutano con il 93% delle modifiche al codice, pur insistendo che l’adozione non sia l’obiettivo in sé.
Cosa c’è dietro tutto questo?
Questa è la legge di Goodhart rinnovata: quando una misura diventa un obiettivo, smette di essere una buona misura. Il conteggio dei token è facile da registrare, motivo per cui è stato scelto, e non ha quasi alcuna relazione con la bontà del lavoro. Puoi bruciare un milione di token su un’attività che un collega ha risolto in dieci minuti con una ricerca.
Il problema più profondo è che l’utilizzo dell’intelligenza artificiale è un input, non un output. Le aziende utilizzano parametri di input quando l’output è difficile da misurare e la qualità del software è notoriamente difficile da misurare. Meta aveva una vera domanda, ovvero se il personale stesse adottando strumenti che aiutassero davvero, e scelse l’unico numero che non poteva rispondere. Vale la pena notare che Meta non si allontana affatto dall’intelligenza artificiale: il 93% di modifiche al codice assistite da agenti è un numero molto alto. Si sta allontanando dal contare.
Che cosa significa per te: Se il tuo datore di lavoro ha iniziato a monitorare l’utilizzo dell’intelligenza artificiale, questo è un utile precedente da sottolineare e proviene da un’azienda che è completamente coinvolta nella tecnologia. La versione onesta della domanda non è “hai utilizzato lo strumento” ma “il lavoro è migliorato o più veloce”. Se usi tu stesso l’intelligenza artificiale, la conclusione è più piccola e più personale: prendila quando ti salva qualcosa di reale e saltala quando non lo fa. Nessuno tiene il punteggio e dove erano loro è andata male.
Fonti
- The Decoder: Meta elimina l’utilizzo dell’intelligenza artificiale dalle revisioni delle prestazioni degli ingegneri
- The Information: Meta comunica agli ingegneri che l’utilizzo dei token AI non farà parte delle revisioni delle prestazioni
- The Pragmatic Engineer: il Tokenmaxxing come una nuova strana tendenza
Microsoft ha corretto un numero record di 973 buchi di sicurezza e un'intelligenza artificiale ne ha individuati alcuni
Il Patch Tuesday di settembre è il più grande di sempre: 973 correzioni, 113 critiche, due già sotto attacco e tre difetti nei prodotti Copilot. Microsoft afferma che un sistema di scansione tramite agenti ha aiutato a far emergere parte del batch.