Token
Il piccolo frammento di testo, circa tre quarti di parola, che i modelli IA leggono e producono.
Un token è l’unità di testo fondamentale con cui lavora un grande modello linguistico. Invece di leggere parole intere o lettere, i modelli suddividono il testo in token, frammenti che in media corrispondono a circa tre quarti di parola. Una parola comune può essere un singolo token, mentre quelle lunghe o insolite vengono divise in più parti.
I token contano per due ragioni pratiche. Primo, la finestra di contesto di un modello, cioè quanto può considerare contemporaneamente, si misura in token e non in parole. Secondo, la maggior parte dei servizi IA fattura per token, quindi la lunghezza dell’input e dell’output incide direttamente sul costo.
Comprendere i token chiarisce molti prezzi e limiti dell’IA: quando un fornitore indica «un milione di token» o fattura per token, parla in realtà di circa altrettanti frammenti di testo in entrata e in uscita.
-
How to Make a 100 Page PDF Answer Your Questions, and Check That It Is Not Making Them Up
-
We Ran a Local AI Model on a Six Year Old Budget Laptop Chip. Here Is Exactly What It Could Do.
-
Un addestramento da 500 dollari fa superare a un modello 9B tutti i modelli di punta in un compito ripetitivo
-
I pesi di Kimi K3 sono finalmente pubblici: occupano 1,4 terabyte
-
Cursor ha ricostruito SQLite con uno sciame di agenti, e i modelli economici hanno fatto quasi tutto
-
La stessa quantità di testo IA: 50 dollari da Anthropic, 87 centesimi da DeepSeek
-
Sakana sostiene che il suo router ora superi persino un modello che non utilizza
-
Opus 5 di Anthropic è più piccolo ed economico, ma supera il fratello maggiore
-
AMD e Cerebras collaborano per far arrivare più velocemente le risposte dell’IA
-
DeepSeek V4 diventa completamente stabile e i vecchi modelli si spengono oggi
-
Google rilascia tre nuovi modelli Gemini, tutti rapidi ed economici, e salta quello che tutti aspettavano
-
La nuova IA per immagini di Alibaba sa disegnare un’intera pagina di giornale, con tanto di testo minuscolo leggibile
-
I prossimi chip IA di Nvidia ricaverebbero dieci volte più lavoro dalla stessa energia
-
Alibaba presenta Qwen3.8 Max e promette di distribuire i pesi
-
OpenAI ha sospeso il suo miglior modello perché continuava a uscire dalla propria gabbia di prova
-
Kimi K3: un modello scaricabile gratuitamente che quasi tiene il passo con i grandi nomi
-
DeepSeek cerca nuovi miliardi poche settimane dopo il primo round: l'IA economica costa cara
-
Anthropic mantiene Fable 5 gratuito per gli abbonati ancora un po': merito della guerra dei prezzi
-
Arrivano i dati indipendenti: Muse Spark 1.1 di Meta offre un rapporto qualità-prezzo notevole
-
OpenAI ammette gli inciampi del grande lancio per il lavoro: ecco cosa correggerà
-
OpenAI afferma che GPT-5.6 Sol ha addestrato il proprio fratello minore
-
Perché Databricks ha scelto un modello open source cinese come motore quotidiano per la programmazione
-
GPT-5.6 Sol quasi eguaglia il miglior modello di IA a un terzo del prezzo
-
Meta entra nella guerra dei prezzi dell'IA con Muse Spark 1.1 e la sua prima API per sviluppatori
-
La risposta di Anthropic al prezzo di Fable 5: lasciare che gestisca modelli più economici
-
Grok 4.5 arriva a un terzo del prezzo, e questo potrebbe contare più dei benchmark
-
MiniMax starebbe progettando un modello open source da 2.700 miliardi di parametri
-
I modelli GPT-5.6 di OpenAI diventano pubblici questo giovedì
-
“Unlimited OCR” di Baidu legge documenti di 40 pagine in una volta sola, imparando a dimenticare
-
Questo strumento open source nasconde il testo nelle immagini per ridurre fino al 70% il costo di Claude
-
Quello strumento IA che sei mesi fa aveva «fallito»? Forse gli serviva soltanto più tempo
-
Tesla ha limitato a 200 dollari a settimana la spesa dei dipendenti per l’IA: il segnale di una fattura inattesa
-
MiniMax M3: un modello IA di fascia alta che puoi scaricare ed eseguire personalmente
-
Più velocità, gratis: Ollama rende l’IA locale fino al 90% più rapida sui Mac