MiniMax M3: un modello IA di fascia alta che puoi scaricare ed eseguire personalmente
Un laboratorio cinese ha pubblicato M3, un modello IA scaricabile gratuitamente che eguaglia i grandi sistemi chiusi nei compiti di programmazione, legge un milione di parole in una volta e gestisce immagini e video. Uno sguardo al perché i modelli «open weight» continuano a ridurre il divario e alle condizioni da leggere con attenzione.
Gran parte delle IA di cui senti parlare, ChatGPT, Claude, Gemini, è rinchiusa nei server aziendali. Noleggi l’accesso, ma non possiedi mai il modello vero e proprio. È quindi degno di nota l’arrivo di un modello autenticamente di fascia alta che chiunque può scaricare ed eseguire personalmente. MiniMax M3, realizzato da un laboratorio cinese, è proprio questo, e possiede capacità impressionanti.
Spiccano due aspetti. Primo: in un noto test che misura la capacità di un modello di correggere autonomamente bug reali del software, SWE-Bench Pro, M3 ottiene il 59%, superando di poco gli ultimi modelli di OpenAI e Google in quello specifico benchmark. Secondo: può mantenere nel contesto circa un milione di token contemporaneamente, in termini molto approssimativi, diversi libri interi di testo in un’unica conversazione, e gestisce immagini e video, non soltanto parole. Se il termine ti è nuovo, un «token» è semplicemente un frammento di testo letto dal modello; più token nel contesto gli permettono di considerare più materiale prima di rispondere.
Come fa a rimanere veloce e accessibile su questa scala? Grazie a una tecnica che il laboratorio chiama sparse attention, cioè attenzione sparsa. Normalmente un modello confronta attentamente ogni parola con tutte le altre, un’operazione che diventa estremamente costosa man mano che il testo si allunga. M3 scorre invece rapidamente il contenuto per trovare le parti davvero importanti e si concentra soltanto su quelle, come un ricercatore che consulta l’indice di un libro invece di rileggerne ogni pagina. Il risultato è un costo di esecuzione drasticamente inferiore sulle grandi lunghezze.
Ora le condizioni scritte in piccolo, perché sono reali. «Open weight» in questo caso non significa «senza vincoli». La licenza permette di usare M3 gratuitamente per scopi non commerciali e a fini commerciali con attribuzione, ma se la tua azienda fattura oltre 20 milioni di dollari l’anno serve un’autorizzazione speciale. Anche l’esecuzione di un contesto da un milione di token richiede molta memoria sulla scheda grafica, quindi non è qualcosa da avviare con noncuranza su un portatile. E un modello proveniente da qualsiasi laboratorio va verificato sulle proprie attività, anziché affidarsi soltanto ai punteggi dei benchmark.
Cosa significa per te: Se desideravi un’IA seria da eseguire sul tuo hardware, per analizzare un’intera base di codice, elaborare documenti lunghi in un solo passaggio o tenere i dati sensibili lontani dal cloud altrui, M3 è un vero candidato che vale la pena provare. Scarica i pesi da Hugging Face, una sorta di app store per modelli IA, testalo sul tuo lavoro reale e prima leggi la licenza alla luce della tua situazione. È questa l’ingegneria lenta e poco appariscente che sta trasformando progressivamente «esegui la tua IA» da slogan a qualcosa che una persona con competenze tecniche può davvero fare questo fine settimana.
Fonti
Usi Cursor? Aggiornalo oggi: sono appena state corrette due gravi falle di sicurezza
I ricercatori di sicurezza hanno trovato due falle critiche in Cursor, il popolare editor di codice IA: bastava aprire un progetto dannoso per permettere agli aggressori di eseguire comandi sul tuo computer. La soluzione è semplice: aggiornare alla versione 3.0. Ecco che cosa è successo e che cosa insegna a tutti noi sugli strumenti IA.