CourionAI
IT
Newsletter
← Tutte le notizie
ai-basics 3 min di lettura

OpenAI ha creato un modello che scrive gli exploit e lo ha consegnato a un breve elenco di aziende

GPT-5.6-Cyber risponde al 95% delle richieste di hacking avanzate mentre il modello normale risponde all'1,5%. Ha già rilevato una vera vulnerabilità di Chrome e oltre 400 bug del kernel.

Un set di grimaldelli sigillati all'interno di una teca di vetro accanto a una pesante porta di legno chiusa con un lucchetto

Tre giorni dopo aver avvertito che il suo prossimo modello potrebbe raggiungere il livello di rischio informatico più alto definito, OpenAI ha comunque spedito un modello di sicurezza informatica a un elenco controllato di partner. GPT-5.6-Cyber ​​è disponibile attraverso un nuovo livello chiamato Daybreak Red, ed è costruito per fare ciò che ogni altro modello rifiuta: trovare vulnerabilità sconosciute e trasformarle in exploit funzionanti.

Il programma di accesso ora ha due livelli. Daybreak Blue offre ai difensori approvati il ​​normale modello di frontiera, GPT-5.6 Sol, con i consueti filtri di sicurezza rilassati per attività di sicurezza legittime come l’analisi del malware, la risposta agli incidenti e la revisione del codice. Daybreak Red aggiunge i modelli addestrati allo scopo. La differenza è evidente nei numeri di OpenAI: in un test interno di richieste avanzate che coprono catene di exploit, bypass di autenticazione ed escalation dei privilegi, GPT-5.6-Cyber ​​completa il 95,0%, contro l’1,5% del modello standard e il 2,0% tramite Daybreak Blue. Il precedente modello cyber riusciva a raggiungere il 57,3%.

Questo non è teorico. OpenAI ha utilizzato il modello su V8, il motore JavaScript all’interno di Chrome, e ha scoperto due difetti precedentemente sconosciuti che si concatenano per corrompere la memoria e uscire dalla sandbox del motore. I ricercatori li hanno verificati, li hanno segnalati a Google e Google ha fornito una correzione come CVE-2026-15903. L’azienda elenca inoltre almeno cinque vulnerabilità in un popolare sistema operativo mobile, tre critiche in un database ampiamente utilizzato e oltre 400 bug di escalation dei privilegi nel kernel di un sistema operativo, tutti ancora divulgati. Secondo il Preparedness Framework di OpenAI, il modello ha un punteggio elevato in termini di capacità informatica, al di sotto della soglia critica, anche se deve ancora arrivare una scheda di sistema completa.

Il ragionamento alla base di tutto ciò è una gara, e OpenAI lo dice chiaramente: gli aggressori useranno l’intelligenza artificiale per attacchi automatizzati, quindi i difensori avranno bisogno prima della stessa potenza di fuoco. Tale argomento è sinceramente contestato. Tutto ciò che trova un varco più velocemente lo apre anche più velocemente, e le garanzie qui sono procedurali piuttosto che tecniche: controlli di identità, monitoraggio, attestazioni legali, restrizioni all’uso approvate e chiavi di sicurezza hardware obbligatorie per i singoli account dal 1° settembre. OpenAI spinge inoltre i clienti Daybreak che utilizzano Codex dalla modalità di accesso completo alla revisione automatica, che controlla le azioni rischiose prima che vengano eseguite. I primi partner includono SpecterOps, SentinelOne e Palo Alto Networks.

Cosa significa per te: niente che tu possa usare, e questo è intenzionale. Non è possibile ottenere questo modello e nessun chatbot consumer ti aiuterà a scrivere un exploit. La parte degna di nota è di seconda mano: se funziona come pubblicizzato, il software che già esegui viene patchato più velocemente, perché una macchina ora legge il codice del kernel alla ricerca di bug a un ritmo che nessun team umano può eguagliare. Il rovescio della medaglia è che la stessa capacità si perde nel tempo, attraverso modelli open weight o attraverso un partner con controlli deboli. Se ci si prende cura dei sistemi al lavoro, l’azione pratica oggi è vecchia e poco affascinante: applicare rapidamente le patch, perché il tempo che intercorre tra la scoperta di un bug e lo sfruttamento è sempre più breve.

Fonti

Fonti: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/

Articolo successivo

OpenAI aggiunge un posto da 125 dollari a ChatGPT Business, perché gli agenti mangiano molto più di Chat

Cinque volte la capacità, nessun limite di cinque ore, cinque volte il prezzo. Il posto standard rimane a 25 dollari e la suddivisione ti dice cosa è cambiato nel modo in cui le persone utilizzano questi strumenti.

Una semplice sedia di legno e una grande poltrona di corallo su un tappeto a motivi geometrici con una clessidra in mezzo