Token
Le petit fragment de texte, environ trois quarts d'un mot, que les modèles d'IA lisent et produisent.
Un token est l’unité de texte de base avec laquelle travaille un grand modèle de langage. Au lieu de lire des mots entiers ou des lettres, les modèles découpent le texte en tokens, des fragments qui correspondent en moyenne à environ trois quarts d’un mot. Un mot courant peut former un seul token, tandis que les mots plus longs ou inhabituels sont divisés en plusieurs unités.
Les tokens ont leur importance pour deux raisons pratiques. Premièrement, la fenêtre de contexte d’un modèle, c’est-à-dire la quantité d’informations qu’il peut prendre en compte à la fois, se mesure en tokens et non en mots. Deuxièmement, la plupart des services d’IA facturent au token : la longueur de votre entrée et de la réponse du modèle influe donc directement sur le coût.
Comprendre les tokens permet d’éclaircir une grande partie de la tarification et des limites de l’IA : lorsqu’un fournisseur annonce « un million de tokens » ou facture au token, il parle en réalité d’environ autant de fragments de texte qui entrent dans le système et en sortent.
-
Anthropic's Fable 5.1 coûte le même prix, sauf pour la partie que les agents utilisent le plus
-
OpenAI expédie GPT-6 Astra et l'appelle son premier cybermodèle critique
-
Un logiciel malveillant vole les connexions de Claude et le panneau d'avertissement indique que votre utilisation s'épuise du jour au lendemain
-
Les poids du GLM-5.3 sont sortis, avec deux semaines de retard et après un examen de sécurité
-
Tencent Open-Sources Hy4, un modèle de 770 milliards de paramètres conçu pour le travail de bureau
-
Granite 4.2 d'IBM est gratuit, suffisamment petit pour fonctionner localement et conçu pour penser avant tout
-
Le GLM-5.3-Flash de Z.ai se rapproche d'Opus à un dixième du prix
-
OpenAI a construit sa propre puce et les premiers benchmarks sont bons
-
Le prochain modèle ouvert d'Alibaba est un aperçu de Qwen 4
-
Anthropic allait augmenter le prix de Claude Sonnet 5 de 50 pour cent. Il vient d'annuler cela
-
OpenAI vient de rendre son meilleur modèle un tiers moins cher, et Claude Opus 5 est soudainement l'option la plus chère
-
Anthropic a mis en œuvre son modèle le plus restreint en analysant le code à la recherche de bogues. Un humain doit encore approuver chaque correctif
-
Anthropic a laissé Claude seul avec 15 cibles protéiques pendant 48 heures, et les résultats du laboratoire sont revenus
-
Regarder son propre modèle coûte désormais 20 % de plus à OpenAI, et il a suspendu une session de formation pour le faire
-
Anthropic aurait payé 7 milliards de dollars pour un logiciel permettant aux puces d'aller plus loin
-
OpenAI a réduit son modèle phare à moitié prix, et la raison se trouve dans un classement
-
Une IA a écrit le bug de sécurité. Une autre IA l'a trouvé cinq jours plus tard
-
Stripe rachète OpenRouter pour plus de 7 milliards de dollars
-
Grok 4.6 arrive dans GitHub Copilot deux jours après son lancement
-
ChatGPT peut maintenant observer ce que vous faites sur votre Mac, avec votre accord
-
Qwen3.8-27B est disponible et fonctionne sur une seule carte graphique de jeu
-
Le meilleur modèle du marché est celui que les entreprises n’achètent pas
-
Le Flash Gemini 3.7 de Google est meilleur en termes de code et coûte deux fois moins cher
-
Ling 3.0 Flash est le modèle ouvert le plus intelligent de sa taille, et il a arrêté d'inventer des choses
-
Someone Else Is Paying for Your AI, Just Not the Part You Think
-
Le fondateur de Rocky Linux veut ouvrir la partie la plus secrète de l'IA : les données d'entraînement
-
Stop Asking Whether AI Is a Bubble. Start Reading the Lease Agreements.
-
Ce conseil sur la langue dans laquelle les codes d'IA sont les meilleurs ? Il s'effondre sur le vrai travail
-
Le nouveau modèle gratuit de Nvidia n'est pas le plus intelligent. C'est juste très, très rapide
-
OpenAI ajoute un siège de 125 dollars à l'activité ChatGPT, car les agents mangent bien plus que le chat
-
Google a transformé un modèle fini en un modèle beaucoup plus rapide et a publié la recette
-
Un climatologue a enregistré huit semaines d’utilisation d’agents d’IA. Il consommait 600 fois plus de puissance par invite qu'un message de chat
-
AMD achète Taalas, une startup qui intègre un modèle d'IA complet dans la puce
-
Des chercheurs ont demandé pourquoi les chatbots sont mauvais avec les feuilles de calcul, et la réponse est plus étrange que prévu
-
Mistral a publié un filtre de sécurité gratuit que vous décrivez en anglais simple et qui tient sur une seule carte graphique.
-
Un modèle de 80 milliards de paramètres fonctionne désormais sur un Mac normal avec 4,3 Go de mémoire, et un modèle de 35 milliards sur un iPhone
-
Qwen3.8-Max d'Alibaba a passé 16 jours à écrire un outil par lui-même, et les poids seront rendus publics la semaine prochaine
-
Des chercheurs ont confié une vraie entreprise, une carte bancaire et 24 heures à un agent IA. Il a perdu 447 dollars
-
Meta a donné à son agent IA un second agent dont le seul travail est de se souvenir
-
On crée des jeux 3D jouables avec un seul prompt, et ils ne ressemblent plus à des blocs
-
AMD entraîne un modèle entièrement ouvert sur ses propres puces, mais réserve les poids à la recherche
-
OpenAI baisse de 80 % le prix de GPT-5.6 Luna sur fond de guerre tarifaire
-
Comment interroger un PDF de 100 pages et vérifier que ses réponses ne sont pas inventées
-
Nous avons fait tourner une IA locale sur un processeur d’entrée de gamme vieux de six ans. Voici ce qu’elle sait vraiment faire.
-
Les poids de Kimi K3 sont enfin publics, et ils occupent 1,4 téraoctet
-
Cursor a reconstruit SQLite avec un essaim d’agents, et les modèles bon marché ont fait l’essentiel
-
La même quantité de texte généré : 50 dollars chez Anthropic, 87 centimes chez DeepSeek
-
AMD et Cerebras s’associent pour accélérer les réponses de l’IA
-
DeepSeek V4 devient pleinement stable, les anciens modèles s’arrêtent aujourd’hui
-
Google veröffentlicht drei neue Gemini-Modelle, alle schnell und günstig, und lässt das erwartete Modell aus
-
Alibabas neue Bild-KI zeichnet ganze Zeitungsseiten, inklusive winziger lesbarer Schrift
-
Les prochaines puces d’IA de Nvidia tireraient dix fois plus de travail de la même énergie
-
Alibaba présente Qwen3.8 Max et promet de donner les poids
-
OpenAI a suspendu son meilleur modèle parce qu'il s'échappait sans cesse de sa propre cage de test
-
Pourquoi Databricks vient d’adopter un modèle chinois open source comme moteur de programmation au quotidien
-
Grok 4.5 arrive pour un tiers du prix, et cela pourrait compter davantage que les évaluations
-
MiniMax préparerait un modèle open source de 2 700 milliards de paramètres
-
Les modèles GPT-5.6 d’OpenAI seront lancés publiquement ce jeudi
-
L’« Unlimited OCR » de Baidu lit des documents de 40 pages d’un seul coup, en apprenant à oublier
-
Cet outil open source dissimule du texte dans des images pour réduire la facture de Claude jusqu’à 70 %
-
Cet outil d’IA qui avait « échoué » il y a six mois ? Il lui fallait peut-être simplement plus de temps
-
Tesla plafonne à 200 dollars par semaine les dépenses d’IA de ses salariés, le signe d’une facture que personne n’avait anticipée
-
MiniMax M3 : un modèle d’IA haut de gamme que vous pouvez télécharger et exécuter vous-même
-
Accélération gratuite : Ollama rend l’IA locale jusqu’à 90 % plus rapide sur Mac