CourionAI
IT
Newsletter
← Tutte le notizie
open-weight 3 min di lettura

Granite 4.2 di IBM è gratuito, sufficientemente piccolo da poter essere eseguito localmente e progettato per pensare innanzitutto

Tre modelli aperti a 3B, 8B e 30B con licenza Apache 2.0, più un modello vocale da 470 milioni di parametri che trascrive tre ore di audio in circa un secondo.

Tre blocchi di pietra di dimensioni decrescenti impilati su una semplice scrivania accanto a un lucchetto aperto

IBM ha rilasciato Granite 4.2, una famiglia di modelli linguistici aperti con dimensioni di parametri di 3 miliardi, 8 miliardi e 30 miliardi, sotto una licenza Apache 2.0. Quella licenza conta più del grafico di riferimento: significa che puoi scaricare i modelli, adattarli ed eseguirli in un prodotto senza chiedere il permesso o pagare una tariffa. Da martedì sono presenti su Hugging Face, Ollama, LM Studio, GitHub e OpenRouter.

Il cambiamento del titolo è il ragionamento nativo. Questi modelli pensano passo dopo passo prima di agire, il che in pratica significa pianificare una sequenza di chiamate agli strumenti anziché licenziarle e sperare. I parametri, grosso modo, sono i numeri interni che un modello apprende durante l’addestramento e il conteggio è un proxy decente della quantità di hardware necessaria: un modello 3B funziona comodamente su un laptop, un modello 8B richiede una scheda grafica ragionevole e 30B è una workstation o un piccolo server.

Per arrivarci sono stati necessari cambiamenti di formazione piuttosto che una maggiore scalabilità. IBM ha aggiunto un regime di apprendimento di rinforzo in più fasi, che consiste in una formazione in cui il modello viene premiato per i buoni risultati piuttosto che per le risposte corrette, iniziando con una fase fondamentale che comprende matematica, scienze, codifica e utilizzo di strumenti. I modelli 8B e 30B sono poi passati attraverso una fase di “RL agente” su attività di tipo aziendale: ingegneria del software, lavoro sui terminali, flussi di lavoro guidati dalla ricerca. I modelli si sono formati anche su un trilione di token di codice sintetico provenienti dalla pipeline CodeAlchemy di IBM, e vengono forniti con uno strato di decodifica speculativa, un trucco che indovina diverse parole in anticipo e le controlla in un unico passaggio, quindi il testo esce più velocemente.

Accanto vengono spediti silenziosamente due modelli vocali, Granite Speech 5.0 Turbo CTC e una variante non commerciale, con soli 470 milioni di parametri. Non hanno alcun modello linguistico al loro interno, ed è questo che li mantiene piccoli. IBM riporta un punteggio di throughput di circa 12.600 su una singola GPU H200 contro i circa 6.000 degli attuali leader di velocità nella classifica Open ASR di Hugging Face, e afferma che il modello trascrive tre ore di voce registrata in circa un secondo.

Cosa sta realmente succedendo qui: IBM non sta cercando di battere GPT-5.6 o Claude. Punta alla noiosa fascia centrale del mercato, dove un’azienda vuole un agente che esegua in modo affidabile lo stesso compito in più fasi diecimila volte, sui propri server, senza che una fattura simbolica o i suoi dati lascino l’edificio. Si tratta di un’esigenza reale e poco soddisfatta, e i pesi aperti e le taglie piccole rappresentano una risposta sensata. I grafici della concorrenza pubblicati da IBM sono i suoi, rispetto a modelli di dimensioni simili, quindi leggili come un’affermazione piuttosto che come un verdetto.

Cosa significa per te: se desideri provare un modello IA capace sul tuo computer, le versioni 3B e 8B rappresentano un punto di partenza insolitamente semplice. ollama run granite4.2 e sarai offline, senza che nulla sia stato inviato da nessuna parte. Non aspettarti la qualità di frontiera; aspettati qualcosa di utile per il riassunto, la stesura e il semplice utilizzo di strumenti che non costa nulla e non può essere interrotto da te.

Fonti

Fonti: https://research.ibm.com/blog/introducing-granite-4-2

Articolo successivo

120 aziende firmano una lettera affermando che la finestra cyber si sta chiudendo

OpenAI, Anthropic, Google, Microsoft, Visa e più di un centinaio di altri avvertono che gli attacchi basati sull’intelligenza artificiale contro ospedali e servizi idrici sono distanti mesi e chiedono una spinta difensiva coordinata.

Un muro di scudi intrecciati affiancato sulla pagina con una torre dell'acqua e un ospedale nascosto dietro di essa