Inferenza
L'esecuzione di un modello IA addestrato per ottenere una risposta, distinta dall'addestramento iniziale.
L’inferenza è l’atto di usare un modello IA addestrato, fornendogli un prompt e ottenendo una risposta. È distinta dall’addestramento, il processo unico e molto più costoso con cui vengono creati inizialmente i pesi del modello.
La distinzione aiuta a comprendere i costi dell’IA. Addestrare un modello di frontiera può richiedere mesi di lavoro e un’enorme potenza di calcolo, ma quel costo viene sostenuto una volta sola. L’inferenza si paga ogni volta che qualcuno usa il modello: per questo i fornitori la misurano, di solito per token, e per questo sono tanto importanti i miglioramenti di efficienza che la rendono più rapida o economica.
È anche il motivo per cui eseguire localmente modelli più piccoli è pratico: persino un buon portatile può gestire l’inferenza per molte attività, anche se non avrebbe mai potuto addestrare da sé il modello.
-
La Gran Bretagna apre una porta da 100 milioni di sterline per le piccole aziende di intelligenza artificiale e consente loro di mantenere la proprietà intellettuale
-
Tencent Open Source Hy4, un modello da 770 miliardi di parametri creato per il lavoro d'ufficio
-
OpenAI ha costruito il proprio chip e i primi benchmark sono buoni
-
Anthropic ha assunto l'uomo che ha costruito i chip IA di Google, e il motivo non è sottile
-
Uno spin-off di Oxford ha venduto ad Anthropic chip per 250 milioni di dollari che ancora non esistono
-
Guardare il proprio modello ora costa a OpenAI il 20% in più e ha sospeso un corso di formazione per farlo
-
Secondo quanto riferito, Anthropic sta pagando 7 miliardi di dollari per un software che consente ai chip di andare oltre
-
Una startup di chip ha raddoppiato il suo valore in un mese essendo deliberatamente inflessibile
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
The Most Valuable AI Skill Is Not Prompting. It Is Verification.
-
Someone Else Is Paying for Your AI, Just Not the Part You Think
-
AMD acquista Taalas, una startup che integra un intero modello di intelligenza artificiale nel chip
-
Cloudflare vuole dare al tuo agente AI un portafoglio e a te il limite di spesa
-
Qualcuno ha fatto funzionare DeepSeek V4 Flash in produzione su una singola scheda AMD e ha pubblicato tutte le patch necessarie
-
AMD ha addestrato un modello completamente aperto sui propri chip, ma senza licenza commerciale
-
Amazon ridimensiona in silenzio gran parte dei suoi modelli di IA
-
AMD e Cerebras collaborano per far arrivare più velocemente le risposte dell’IA
-
I prossimi chip IA di Nvidia ricaverebbero dieci volte più lavoro dalla stessa energia
-
Kimi K3 è diventato troppo popolare: Moonshot sospende i nuovi abbonamenti
-
DeepSeek cerca nuovi miliardi poche settimane dopo il primo round: l'IA economica costa cara
-
DeepSeek progetta un proprio chip per l'IA e raccoglie per la prima volta capitali esterni