Token
Le petit fragment de texte, environ trois quarts d'un mot, que les modèles d'IA lisent et produisent.
Un token est l’unité de texte de base avec laquelle travaille un grand modèle de langage. Au lieu de lire des mots entiers ou des lettres, les modèles découpent le texte en tokens, des fragments qui correspondent en moyenne à environ trois quarts d’un mot. Un mot courant peut former un seul token, tandis que les mots plus longs ou inhabituels sont divisés en plusieurs unités.
Les tokens ont leur importance pour deux raisons pratiques. Premièrement, la fenêtre de contexte d’un modèle, c’est-à-dire la quantité d’informations qu’il peut prendre en compte à la fois, se mesure en tokens et non en mots. Deuxièmement, la plupart des services d’IA facturent au token : la longueur de votre entrée et de la réponse du modèle influe donc directement sur le coût.
Comprendre les tokens permet d’éclaircir une grande partie de la tarification et des limites de l’IA : lorsqu’un fournisseur annonce « un million de tokens » ou facture au token, il parle en réalité d’environ autant de fragments de texte qui entrent dans le système et en sortent.
-
How to Make a 100 Page PDF Answer Your Questions, and Check That It Is Not Making Them Up
-
We Ran a Local AI Model on a Six Year Old Budget Laptop Chip. Here Is Exactly What It Could Do.
-
Les poids de Kimi K3 sont enfin publics, et ils occupent 1,4 téraoctet
-
Cursor a reconstruit SQLite avec un essaim d’agents, et les modèles bon marché ont fait l’essentiel
-
La même quantité de texte généré : 50 dollars chez Anthropic, 87 centimes chez DeepSeek
-
AMD et Cerebras s’associent pour accélérer les réponses de l’IA
-
DeepSeek V4 devient pleinement stable, les anciens modèles s’arrêtent aujourd’hui
-
Google veröffentlicht drei neue Gemini-Modelle, alle schnell und günstig, und lässt das erwartete Modell aus
-
Alibabas neue Bild-KI zeichnet ganze Zeitungsseiten, inklusive winziger lesbarer Schrift
-
Les prochaines puces d’IA de Nvidia tireraient dix fois plus de travail de la même énergie
-
Alibaba présente Qwen3.8 Max et promet de donner les poids
-
OpenAI a suspendu son meilleur modèle parce qu'il s'échappait sans cesse de sa propre cage de test
-
Pourquoi Databricks vient d’adopter un modèle chinois open source comme moteur de programmation au quotidien
-
Grok 4.5 arrive pour un tiers du prix, et cela pourrait compter davantage que les évaluations
-
MiniMax préparerait un modèle open source de 2 700 milliards de paramètres
-
Les modèles GPT-5.6 d’OpenAI seront lancés publiquement ce jeudi
-
L’« Unlimited OCR » de Baidu lit des documents de 40 pages d’un seul coup, en apprenant à oublier
-
Cet outil open source dissimule du texte dans des images pour réduire la facture de Claude jusqu’à 70 %
-
Cet outil d’IA qui avait « échoué » il y a six mois ? Il lui fallait peut-être simplement plus de temps
-
Tesla plafonne à 200 dollars par semaine les dépenses d’IA de ses salariés, le signe d’une facture que personne n’avait anticipée
-
MiniMax M3 : un modèle d’IA haut de gamme que vous pouvez télécharger et exécuter vous-même
-
Accélération gratuite : Ollama rend l’IA locale jusqu’à 90 % plus rapide sur Mac