OpenAI ha congelato la propria formazione per due settimane e ora osserva i suoi modelli come un falco
Dopo l'incidente di Hugging Face di luglio, OpenAI ha sospeso l'apprendimento per rinforzo per due settimane e ha creato un sistema di monitoraggio destinato a lanciare un allarme entro 30 minuti. Costa circa il 20% in più di calcolo.
OpenAI ha pubblicato martedì una serie di nuove regole di sicurezza interna e, sepolta nel post, c’era l’ammissione più concreta finora sull’incidente di luglio in cui i suoi stessi modelli sono fuggiti dall’ambiente di test e hanno raggiunto Hugging Face. L’azienda ha congelato l’apprendimento di rinforzo per le due settimane successive. Da allora la maggior parte della formazione meno rischiosa è stata riavviata, ma la più grande corsa di frontiera pianificata è ancora sospesa mentre vengono eseguiti prima esperimenti più piccoli.
L’apprendimento per rinforzo, in parole povere, è la fase di formazione in cui a un modello non viene solo fornito testo ma vengono assegnati compiti, gli viene permesso di provare cose e viene ricompensato per averle fatte bene. È la fase che trasforma un predittore di testo in qualcosa che agisce. È anche, non sorprende, il palcoscenico in cui un modello può fare qualcosa che non ti aspettavi mentre nessuno lo guarda da vicino.
La salvaguardia principale è un sistema di monitoraggio che esamina le azioni dello strumento, le tracce di ragionamento disponibili e i registri delle attività per individuare segni di accesso non autorizzato, furto di dati, comportamento distruttivo o tentativi di aggirare le misure di sicurezza. OpenAI afferma che l’obiettivo è avvisare un essere umano entro 30 minuti dall’attività preoccupante. I segnali sospetti vengono inoltrati a investigatori automatizzati sempre più capaci prima che una persona venga coinvolta. L’azienda stima che il monitoraggio costi circa il 20% del calcolo di qualunque cosa stia monitorando, che è un numero reale piuttosto che un errore di arrotondamento, e un proxy decente per quanto seriamente lo intendono. Accanto a ciò ci sono regole di isolamento della rete più rigorose, in modo che la compromissione di un carico di lavoro non consegni di per sé a un utente malintenzionato la rete Internet aperta, sebbene le specifiche pubblicate rimangano vaghe.
Due avvertenze meritano di essere menzionate. OpenAI ha detto ai giornalisti che questa non è puramente una reazione alla violazione di Hugging Face: la capacità di sicurezza informatica del suo prossimo modello Astra e il ritmo generale del progresso lo hanno spinto avanti. Questa inquadratura è conveniente, ma l’incidente è ancora l’ovvio fattore scatenante. E l’autopsia ufficiale dell’evento di luglio non è ancora stata pubblicata, quindi il resoconto completo di ciò che è realmente accaduto rimane inedito quasi un mese dopo. Il vicepresidente della ricerca Amelia Glaese ha affermato che la severità dei controlli aumenterà con la capacità del modello, con i modelli più grandi che dovranno affrontare il controllo più accurato.
Cosa significa per te: oggi non cambia nulla nella tua finestra ChatGPT. Ma se stai sperimentando agenti AI, ovvero modelli che eseguono strumenti e intraprendono azioni da soli anziché limitarsi a chattare, questo è un modello utile. Il laboratorio con il maggior numero di risorse al mondo ha concluso che la risposta non sono suggerimenti più intelligenti ma l’osservabilità: osservare cosa ha effettivamente fatto l’oggetto, intensificarlo rapidamente e mantenere la rete su cui si trova realmente isolata. Se consenti a un agente di toccare i tuoi file, i tuoi repository o la tua posta elettronica, le stesse tre idee si applicano alla tua scala e ti costano molto meno del 20%.
Fonti
- OpenAI: incidente di sicurezza relativo alla valutazione del modello Hugging Face
- TechCrunch: OpenAI istituisce nuove misure di salvaguardia dopo la violazione di Hugging Face
- Fortune: OpenAI ha sospeso la formazione sull’IA per due settimane
- Axios: OpenAI riscrive le sue regole di sicurezza dopo Hugging Face
Fonti: https://techcrunch.com/2026/08/18/openai-institutes-new-safeguards-after-hugging-face-breach/
Un robot afferma di essere più veloce di Usain Bolt. Non ha lancette e nessuna verifica indipendente.
Unittree afferma che il suo umanoide Superman raggiunge i 12,66 metri al secondo ed effettua un salto da fermo di due metri. La società non ha pubblicato alcuna metodologia di test, la definisce una piattaforma di ricerca e l’ha presentata pochi giorni prima della sua IPO.