CourionAI
IT
Newsletter
← Tutte le notizie
openai 2 min di lettura

I modelli GPT-5.6 di OpenAI diventano pubblici questo giovedì

Dopo settimane di accesso limitato, GPT-5.6 Sol, Terra e Luna di OpenAI diventano pubblici giovedì, con risultati nei benchmark superiori a Claude Mythos 5 e prezzi nettamente inferiori.

Illustrazione in stile risograph di un sole radioso, un piccolo pianeta e una luna crescente che sorgono insieme sopra un cancello di partenza aperto

L’attesa è finita: la famiglia GPT-5.6 di OpenAI, composta da Sol, Terra e Luna, verrà lanciata pubblicamente questo giovedì. I modelli erano stati presentati alla fine di giugno, ma inizialmente erano limitati ad alcuni partner mentre il Center for AI Standards and Innovation (CAISI) del governo statunitense svolgeva ulteriori test di sicurezza. Secondo Axios, il Dipartimento del Commercio ha ora autorizzato il lancio pubblico.

Vale la pena osservare i dati condivisi da OpenAI. Su TerminalBench 2.1, un benchmark che misura la capacità di un modello di gestire vero lavoro di programmazione nel terminale, l’ambiente a riga di comando usato dagli sviluppatori, GPT-5.6 Sol Ultra ha ottenuto il 91,9% e Sol standard l’88,8%, superando di poco Claude Mythos 5 di Anthropic, fermo all’88,0%. Gemini 3.1 Pro Preview di Google è rimasto indietro con il 70,7%. Nelle attività di cybersicurezza, a quanto risulta Sol ha eguagliato Mythos 5 usando soltanto un terzo dei token, i piccoli frammenti di testo letti e scritti da un modello che determinano anche il prezzo da pagare.

Quest’ultimo aspetto conta più delle vanterie sui benchmark. Sol costa 5 dollari per milione di token in ingresso e 30 dollari per milione di token in uscita. Fable 5 di Anthropic costa quasi il doppio, 10 e 50 dollari, e secondo le indiscrezioni tende per di più a usare un maggior numero di token per lo stesso lavoro. Se le affermazioni sull’efficienza saranno confermate nella pratica, la differenza nei costi reali potrebbe superare quella indicata dal listino.

Ecco cosa c’è dietro l’insolito percorso di lancio: GPT-5.6 è il primo grande modello sottoposto a una revisione governativa prima di raggiungere il pubblico. OpenAI ha criticato apertamente il blocco, sostenendo che sottraesse agli sviluppatori gli strumenti migliori. Il modello più capace di Anthropic è stato recentemente sottoposto a un processo analogo. Non esiste ancora un insieme di regole vincolanti che stabilisca quando e come condurre queste revisioni: finora si procede caso per caso, ed è proprio questo a irritare i laboratori.

Cosa significa per te: se usi ChatGPT, aspettati di vedere comparire i nuovi modelli poco dopo giovedì, probabilmente con miglioramenti evidenti nella programmazione e nelle attività articolate in più passaggi. Se sviluppi sulle API, il titolo è il prezzo: un modello di frontiera alla metà della tariffa di Anthropic esercita una vera pressione sul mercato, e la pressione sui prezzi finisce di solito per avvantaggiare gli utenti. Una precisazione doverosa: i benchmark della settimana di lancio provengono dalla stessa azienda. Aspetta test indipendenti prima di riorganizzare i tuoi strumenti.

Fonti

Fonti: https://openai.com/index/previewing-gpt-5-6-sol

Articolo successivo

Microsoft sostituisce in sordina OpenAI e Anthropic in Copilot per ridurre i costi

I modelli MAI interni di Microsoft stanno sostituendo OpenAI e Anthropic in Excel e Outlook: i clienti potrebbero ricevere un'IA meno capace allo stesso prezzo di abbonamento.

Illustrazione in stile risograph di un nastro trasportatore che sostituisce un grande motore elaborato con uno più piccolo e semplice mentre alcune monete cadono in un barattolo