Qwen3.8-27B è disponibile e funziona su una sola scheda grafica da gioco
Alibaba ha finalmente pubblicato la metà piccola della promessa Qwen3.8. Il modello da 27 miliardi di parametri è arrivato primo su Hacker News perché può davvero funzionare a casa.
Alibaba ha pubblicato oggi Qwen3.8-27B e in poche ore era primo su Hacker News con 893 punti. La ragione è semplice: a differenza del gigantesco Qwen3.8-Max i cui pesi sono arrivati tre giorni fa, questo entra in hardware comune. Basta una RTX 4090 o un Mac Studio, usando una versione compressa.
Il modello è denso, quindi tutti i 27 miliardi di parametri lavorano per ogni parola, e gestisce immagini e testo. Il contesto nativo, cioè il testo che può tenere presente, è di 262.144 token, circa un libro molto lungo. Le velocità riferite vanno da 10 token al secondo con forte compressione a circa 160 su Nvidia DGX Spark con decodifica speculativa, dove un modello piccolo propone parole che quello grande verifica insieme.
I benchmark richiedono cautela. La scheda Alibaba assegna 61,7 su SWE-bench Pro, un test su veri problemi software, contro 53,4 per una configurazione Claude Opus. Quella riga sostiene quasi tutti i titoli sul «rivale di Claude Opus». Negli altri quattro test, compresi Terminal-Bench e Humanity’s Last Exam, il modello piccolo è indietro, a volte molto: 30,8 contro 40,0 nell’ultimo.
I benchmark dei fornitori sono documenti di marketing oltre che misure. I commentatori hanno notato strutture agentiche, temperature e prompt differenti, rendendo fragile il confronto diretto. Resta anche il timore che i laboratori ottimizzino per test famosi. Nulla di questo rende il rilascio poco notevole. Un anno fa sarebbe sembrato assurdo che un modello locale da 27 miliardi si avvicinasse a un modello commerciale di frontiera.
Un limite da sapere: il modello ha un controllo dello sforzo di ragionamento. Su xhigh, richieste semplici hanno richiesto da 20 a 90 minuti. Per l’uso quotidiano scegli medium o low.
Cosa significa per te: se non hai mai eseguito un modello sul tuo computer, è un buon momento. LM Studio elenca le versioni compresse e consente l’installazione senza terminale. Nulla lascia la macchina, importante per documenti privati. Se usi già un assistente ospitato per programmare, mantieni aspettative tranquille: i modelli locali si avvicinano, ma la differenza resta sui lavori difficili. L’opzione gratuita e privata è migliorata visibilmente questa settimana.
Fonti
Un verbalizzatore IA ha lasciato 181.874 riunioni aperte a qualsiasi account gratuito
Un ricercatore ha scoperto che tl;dv, un registratore di riunioni usato da oltre due milioni di persone, permetteva a ogni utente registrato di elencare tutte le riunioni, comprese le chiamate in diretta.