Token
Il piccolo frammento di testo, circa tre quarti di parola, che i modelli IA leggono e producono.
Un token è l’unità di testo fondamentale con cui lavora un grande modello linguistico. Invece di leggere parole intere o lettere, i modelli suddividono il testo in token, frammenti che in media corrispondono a circa tre quarti di parola. Una parola comune può essere un singolo token, mentre quelle lunghe o insolite vengono divise in più parti.
I token contano per due ragioni pratiche. Primo, la finestra di contesto di un modello, cioè quanto può considerare contemporaneamente, si misura in token e non in parole. Secondo, la maggior parte dei servizi IA fattura per token, quindi la lunghezza dell’input e dell’output incide direttamente sul costo.
Comprendere i token chiarisce molti prezzi e limiti dell’IA: quando un fornitore indica «un milione di token» o fattura per token, parla in realtà di circa altrettanti frammenti di testo in entrata e in uscita.
-
OpenAI afferma che i suoi agenti di codifica ora funzionano tre giorni per ogni giorno umano
-
Anthropic's Fable 5.1 costa lo stesso, ad eccezione della parte che gli agenti utilizzano maggiormente
-
Gemini 3.8 Flash di Google mantiene il vecchio prezzo e porta un Cyber Twin
-
OpenAI lancia GPT-6 Astra e lo definisce il suo primo modello informatico critico
-
K2 Horizon fornisce sei modelli aperti e con essi i dati di addestramento
-
Il livello di modello più economico di Meta costa 21 volte meno e si addestra secondo le tue richieste
-
Il malware sta rubando gli accessi di Claude e il segnale di avvertimento è che il tuo utilizzo si sta esaurendo da un giorno all'altro
-
I pesi di GLM-5.3 sono stati pubblicati, con due settimane di ritardo e dopo una revisione della sicurezza
-
Tencent Open Source Hy4, un modello da 770 miliardi di parametri creato per il lavoro d'ufficio
-
Granite 4.2 di IBM è gratuito, sufficientemente piccolo da poter essere eseguito localmente e progettato per pensare innanzitutto
-
Il GLM-5.3-Flash di Z.ai si avvicina all'Opus a un decimo del prezzo
-
OpenAI ha costruito il proprio chip e i primi benchmark sono buoni
-
Il prossimo modello aperto di Alibaba è un'anteprima di Qwen 4
-
La nuova Agentic Search di Mistral consente all'intelligenza artificiale di leggere effettivamente i tuoi documenti
-
Anthropic avrebbe fatto aumentare il prezzo di Claude Sonnet 5 del 50%. Lo ha appena cancellato
-
OpenAI ha appena reso il suo modello migliore un terzo più economico e Claude Opus 5 è improvvisamente l'opzione più costosa
-
Anthropic ha messo in funzione il suo modello più limitato scansionando il codice alla ricerca di bug. Un essere umano deve ancora approvare ogni correzione
-
Il modello economico di DeepSeek ora può vedere e supera l'Opus 4.8 con due test visivi
-
È apparso un modello di classe Frontiera senza nome ed è gratuito fino alla prossima settimana
-
Anthropic ha lasciato Claude da solo con 15 bersagli proteici per 48 ore e sono arrivati i risultati di laboratorio
-
Guardare il proprio modello ora costa a OpenAI il 20% in più e ha sospeso un corso di formazione per farlo
-
Secondo quanto riferito, Anthropic sta pagando 7 miliardi di dollari per un software che consente ai chip di andare oltre
-
OpenAI ha tagliato il suo modello di punta a metà prezzo e il motivo è essere in cima alla classifica
-
Un'intelligenza artificiale ha scritto il bug di sicurezza. Un'altra IA l'ha trovata cinque giorni dopo
-
Una startup di chip ha raddoppiato il suo valore in un mese essendo deliberatamente inflessibile
-
Stripe compra OpenRouter per oltre 7 miliardi di dollari
-
Grok 4.6 arriva in GitHub Copilot due giorni dopo il lancio
-
ChatGPT può osservare ciò che fai sul Mac, se glielo permetti
-
Qwen3.8-27B è disponibile e funziona su una sola scheda grafica da gioco
-
Deepseek ha ceduto il suo software agente e aumentato i prezzi delle API lo stesso giorno
-
Il miglior modello sul mercato è quello che le aziende non acquistano
-
Gemini 3.7 Flash di Google è migliore nel codice e costa la metà
-
Ling 3.0 Flash è il modello aperto più intelligente delle sue dimensioni e ha smesso di inventare cose
-
La nuova modalità ultraveloce di OpenAI esegue il suo modello migliore 14 volte più velocemente
-
Someone Else Is Paying for Your AI, Just Not the Part You Think
-
Il fondatore di Rocky Linux vuole aprire la parte più segreta dell'IA: i dati di addestramento
-
Stop Asking Whether AI Is a Bubble. Start Reading the Lease Agreements.
-
Quel consiglio su quale lingua è migliore per i codici AI? Cade a pezzi nel lavoro reale
-
Il nuovo modello gratuito di Nvidia non è il più intelligente. È semplicemente molto, molto veloce
-
Meta ha messo un modello 30B sul tuo laptop e Zuckerberg ha utilizzato il lancio per combattere
-
OpenAI aggiunge un posto da 125 dollari a ChatGPT Business, perché gli agenti mangiano molto più di Chat
-
Google ha trasformato un modello finito in uno molto più veloce e ha pubblicato la ricetta
-
Uno scienziato del clima ha registrato otto settimane di utilizzo dell’agente AI. Ha attirato 600 volte più potenza per prompt rispetto a un messaggio di chat
-
Claude Code attiva la modalità Auto Mode per impostazione predefinita e i numeri di sicurezza non sono quelli che indovineresti
-
AMD acquista Taalas, una startup che integra un intero modello di intelligenza artificiale nel chip
-
Il nuovo modello di Alibaba ottiene punteggi più alti e indovina di più: il tasso di allucinazioni passa dal 23 al 40%
-
I ricercatori si sono chiesti perché i chatbot non siano efficaci con i fogli di calcolo e la risposta è più strana del previsto
-
Mistral ha rilasciato un filtro di sicurezza gratuito che descrivi in un inglese semplice e si adatta a una scheda grafica
-
Un modello da 80 miliardi di parametri ora funziona su un normale Mac con 4,3 GB di memoria e uno da 35 miliardi su un iPhone
-
Karpathy ha trasformato un paragrafo di Tolkien in una scena 3D per dieci dollari e l'ha definito un vibe check
-
I ricercatori hanno dato a un agente IA un'azienda vera, una carta bancaria e 24 ore. Ha perso 447 dollari
-
Meta ha dato al suo agente IA un secondo agente con un solo compito: ricordare
-
Con un solo prompt si costruiscono giochi 3D giocabili, e non sembrano più blocchi colorati
-
AMD ha addestrato un modello completamente aperto sui propri chip, ma senza licenza commerciale
-
DeepSeek aggiorna il suo modello economico e raggiunge quello di OpenAI
-
Il laboratorio di Mira Murati riduce il modello a meno di un terzo e perde un solo punto
-
OpenAI taglia dell'80% il prezzo di GPT-5.6 Luna mentre si accende la guerra dei prezzi
-
Come interrogare un PDF di 100 pagine e verificare che non inventi le risposte
-
Anthropic: Claude ha scoperto due vere debolezze negli algoritmi crittografici
-
Abbiamo eseguito un’IA locale su un processore economico di sei anni fa. Ecco cosa riesce davvero a fare.
-
I pesi di Kimi K3 sono finalmente pubblici: occupano 1,4 terabyte
-
Un addestramento da 500 dollari fa superare a un modello 9B tutti i modelli di punta in un compito ripetitivo
-
Cursor ha ricostruito SQLite con uno sciame di agenti, e i modelli economici hanno fatto quasi tutto
-
La stessa quantità di testo IA: 50 dollari da Anthropic, 87 centesimi da DeepSeek
-
Sakana sostiene che il suo router ora superi persino un modello che non utilizza
-
Opus 5 di Anthropic è più piccolo ed economico, ma supera il fratello maggiore
-
AMD e Cerebras collaborano per far arrivare più velocemente le risposte dell’IA
-
DeepSeek V4 diventa completamente stabile e i vecchi modelli si spengono oggi
-
Google rilascia tre nuovi modelli Gemini, tutti rapidi ed economici, e salta quello che tutti aspettavano
-
La nuova IA per immagini di Alibaba sa disegnare un’intera pagina di giornale, con tanto di testo minuscolo leggibile
-
I prossimi chip IA di Nvidia ricaverebbero dieci volte più lavoro dalla stessa energia
-
Alibaba presenta Qwen3.8 Max e promette di distribuire i pesi
-
OpenAI ha sospeso il suo miglior modello perché continuava a uscire dalla propria gabbia di prova
-
Kimi K3: un modello scaricabile gratuitamente che quasi tiene il passo con i grandi nomi
-
DeepSeek cerca nuovi miliardi poche settimane dopo il primo round: l'IA economica costa cara
-
Anthropic mantiene Fable 5 gratuito per gli abbonati ancora un po': merito della guerra dei prezzi
-
Arrivano i dati indipendenti: Muse Spark 1.1 di Meta offre un rapporto qualità-prezzo notevole
-
OpenAI ammette gli inciampi del grande lancio per il lavoro: ecco cosa correggerà
-
OpenAI afferma che GPT-5.6 Sol ha addestrato il proprio fratello minore
-
Perché Databricks ha scelto un modello open source cinese come motore quotidiano per la programmazione
-
GPT-5.6 Sol quasi eguaglia il miglior modello di IA a un terzo del prezzo
-
Meta entra nella guerra dei prezzi dell'IA con Muse Spark 1.1 e la sua prima API per sviluppatori
-
La risposta di Anthropic al prezzo di Fable 5: lasciare che gestisca modelli più economici
-
Grok 4.5 arriva a un terzo del prezzo, e questo potrebbe contare più dei benchmark
-
MiniMax starebbe progettando un modello open source da 2.700 miliardi di parametri
-
I modelli GPT-5.6 di OpenAI diventano pubblici questo giovedì
-
“Unlimited OCR” di Baidu legge documenti di 40 pagine in una volta sola, imparando a dimenticare
-
Questo strumento open source nasconde il testo nelle immagini per ridurre fino al 70% il costo di Claude
-
Quello strumento IA che sei mesi fa aveva «fallito»? Forse gli serviva soltanto più tempo
-
Tesla ha limitato a 200 dollari a settimana la spesa dei dipendenti per l’IA: il segnale di una fattura inattesa
-
MiniMax M3: un modello IA di fascia alta che puoi scaricare ed eseguire personalmente
-
Più velocità, gratis: Ollama rende l’IA locale fino al 90% più rapida sui Mac