Token
Das kleine Textstück von durchschnittlich etwa drei Vierteln eines Wortes, das KI-Modelle lesen und erzeugen.
Ein Token ist die grundlegende Texteinheit, mit der ein großes Sprachmodell arbeitet. Statt ganze Wörter oder einzelne Buchstaben zu lesen, zerlegt ein Modell Text in Tokens, Stücke, die im Durchschnitt ungefähr drei Vierteln eines Wortes entsprechen. Häufige Wörter können ein einzelnes Token sein, längere oder ungewöhnliche Wörter werden in mehrere zerlegt.
Tokens sind aus zwei praktischen Gründen wichtig. Erstens wird das Kontextfenster eines Modells, wie viel es auf einmal berücksichtigen kann, in Tokens und nicht in Wörtern gemessen. Zweitens rechnen die meisten KI-Dienste pro Token ab. Die Länge deiner Eingabe und der Ausgabe des Modells beeinflusst damit unmittelbar die Kosten.
Wer Tokens versteht, durchschaut viele Preisangaben und Grenzen leichter: Wenn ein Anbieter „eine Million Tokens“ nennt oder pro Token abrechnet, spricht er ungefähr von dieser Anzahl ein- und ausgehender Textstücke.
-
How to Make a 100 Page PDF Answer Your Questions, and Check That It Is Not Making Them Up
-
We Ran a Local AI Model on a Six Year Old Budget Laptop Chip. Here Is Exactly What It Could Do.
-
Die Gewichte von Kimi K3 sind endlich öffentlich – und 1,4 Terabyte schwer
-
Cursor baute SQLite mit einem Agentenschwarm nach, und günstige Modelle erledigten den Großteil
-
Derselbe Berg KI-Ausgabe: 50 US-Dollar bei Anthropic, 87 Cent bei DeepSeek
-
Sakana sagt, sein Modell-Router schlägt jetzt ein Modell, das er gar nicht nutzt
-
Anthropics Opus 5 ist kleiner und günstiger, und schlägt trotzdem sein größeres Geschwistermodell
-
AMD und Cerebras tun sich zusammen, damit KI-Antworten schneller erscheinen
-
DeepSeek V4 ist vollständig stabil, die alten Modelle werden heute abgeschaltet
-
Google veröffentlicht drei neue Gemini-Modelle, alle schnell und günstig, und lässt das erwartete Modell aus
-
Alibabas neue Bild-KI zeichnet ganze Zeitungsseiten, inklusive winziger lesbarer Schrift
-
Nvidias nächste KI-Chips holen Berichten zufolge zehnmal mehr Arbeit aus derselben Energie
-
Alibaba zeigt Qwen3.8 Max vorab und will die Gewichte verschenken
-
OpenAI pausierte sein bestes Modell, weil es wiederholt aus seinem eigenen Testkäfig ausbrach
-
Kimi K3: Ein kostenlos herunterladbares Modell, das fast mit den großen Namen mithält
-
Anthropic hält Fable 5 für Abonnenten etwas länger kostenlos, dank des Preiskriegs
-
Unabhängige Zahlen liegen vor: Metas Muse Spark 1.1 ist eine ernsthafte Preis-Leistungs-Wahl
-
OpenAI räumt ein, dass der große Arbeitsstart stolperte, das wird jetzt korrigiert
-
OpenAI sagt, GPT-5.6 Sol habe seinen eigenen kleineren Bruder trainiert
-
GPT-5.6 Sol erreicht beinahe das beste KI-Modell, für ein Drittel des Preises
-
Meta steigt mit Muse Spark 1.1 und seiner ersten Entwickler-API in den KI-Preiskampf ein
-
Anthropics Antwort auf den Preis von Fable 5: Das Modell soll günstigere Modelle steuern
-
Grok 4.5 kommt zum Drittel des Preises, und das könnte wichtiger sein als Benchmarks
-
MiniMax plant Berichten zufolge ein Open-Source-Modell mit 2,7 Billionen Parametern
-
OpenAIs GPT-5.6-Modelle starten diesen Donnerstag öffentlich
-
Baidus „Unlimited OCR“ liest 40-seitige Dokumente in einem Durchgang, indem es zu vergessen lernt
-
Dieses Open-Source-Werkzeug versteckt Text in Bildern und senkt Claudes Kosten um bis zu 70 Prozent
-
Das KI-Werkzeug, das vor sechs Monaten „gescheitert“ ist? Vielleicht brauchte es einfach mehr Zeit
-
Tesla begrenzt die KI-Ausgaben seiner Mitarbeiter auf 200 Dollar pro Woche, ein Zeichen für eine Rechnung, mit der niemand gerechnet hatte
-
MiniMax M3: Ein Spitzenmodell der KI, das du herunterladen und selbst betreiben kannst
-
Kostenloser Geschwindigkeitsschub: Ollama macht lokale KI auf Macs bis zu 90 Prozent schneller