Token
Das kleine Textstück von durchschnittlich etwa drei Vierteln eines Wortes, das KI-Modelle lesen und erzeugen.
Ein Token ist die grundlegende Texteinheit, mit der ein großes Sprachmodell arbeitet. Statt ganze Wörter oder einzelne Buchstaben zu lesen, zerlegt ein Modell Text in Tokens, Stücke, die im Durchschnitt ungefähr drei Vierteln eines Wortes entsprechen. Häufige Wörter können ein einzelnes Token sein, längere oder ungewöhnliche Wörter werden in mehrere zerlegt.
Tokens sind aus zwei praktischen Gründen wichtig. Erstens wird das Kontextfenster eines Modells, wie viel es auf einmal berücksichtigen kann, in Tokens und nicht in Wörtern gemessen. Zweitens rechnen die meisten KI-Dienste pro Token ab. Die Länge deiner Eingabe und der Ausgabe des Modells beeinflusst damit unmittelbar die Kosten.
Wer Tokens versteht, durchschaut viele Preisangaben und Grenzen leichter: Wenn ein Anbieter „eine Million Tokens“ nennt oder pro Token abrechnet, spricht er ungefähr von dieser Anzahl ein- und ausgehender Textstücke.
-
OpenAI gibt an, dass seine Codierungsagenten jetzt für jeden Menschentag drei Tage arbeiten
-
Anthropics Fable 5.1 kostet das Gleiche, mit Ausnahme des Teils, den die Agenten am häufigsten nutzen
-
Googles Gemini 3.8 Flash behält den alten Preis und bringt einen Cyber Twin mit
-
OpenAI liefert GPT-6 Astra aus und nennt es sein erstes kritisches Cyber-Modell
-
K2 Horizon liefert sechs offene Modelle und die dazugehörigen Trainingsdaten aus
-
Die günstigste Modellstufe von Meta kostet 21-mal weniger und reagiert auf Ihre Vorgaben
-
Malware stiehlt Claude-Logins und das Warnzeichen ist, dass Ihre Nutzung über Nacht erschöpft ist
-
Die Gewichtungen von GLM-5.3 liegen mit zwei Wochen Verspätung und nach einer Sicherheitsüberprüfung vor
-
Tencent Open-Sources Hy4, ein 770-Milliarden-Parameter-Modell, das für die Büroarbeit entwickelt wurde
-
Granite 4.2 von IBM ist kostenlos, klein genug, um lokal ausgeführt zu werden, und darauf ausgelegt, zuerst zu denken
-
Der GLM-5.3-Flash von Z.ai kommt zu einem Zehntel des Preises in die Nähe von Opus
-
OpenAI hat seinen eigenen Chip gebaut und die ersten Benchmarks sind gut
-
Alibabas nächstes offenes Modell ist eine Vorschau auf Qwen 4
-
Die neue Agentensuche von Mistral ermöglicht es der KI, Ihre Dokumente tatsächlich zu lesen
-
Anthropic wollte den Preis von Claude Sonnet 5 um 50 Prozent erhöhen. Es hat das einfach abgesagt
-
OpenAI hat gerade sein bestes Modell um ein Drittel günstiger gemacht, und Claude Opus 5 ist plötzlich die teurere Option
-
Anthropic setzt sein am stärksten eingeschränktes Modell ein, um Code nach Fehlern zu scannen. Ein Mensch muss immer noch jede Reparatur genehmigen
-
Das günstige Modell von DeepSeek kann jetzt sehen und übertrifft Opus 4.8 bei zwei visuellen Tests
-
Ein Modell der Frontier-Klasse ist ohne Namen aufgetaucht und bis nächste Woche kostenlos erhältlich
-
Anthropic ließ Claude 48 Stunden lang mit 15 Proteinzielen allein und die Laborergebnisse kamen zurück
-
Das Ansehen seines eigenen Modells kostet OpenAI jetzt 20 Prozent mehr, und dafür wurde ein Trainingslauf unterbrochen
-
Anthropic zahlt Berichten zufolge 7 Milliarden Dollar für Software, die Chips weiterbringt
-
OpenAI hat sein Flaggschiffmodell auf die Hälfte des Preises reduziert, und der Grund dafür ist, dass es auf einer Bestenliste steht
-
Eine KI hat den Sicherheitsfehler geschrieben. Eine andere KI fand es fünf Tage später
-
Ein Chip-Startup verdoppelte seinen Wert innerhalb eines Monats durch bewusste Unflexibilität
-
Stripe kauft OpenRouter für mehr als 7 Milliarden Dollar
-
Grok 4.6 erscheint zwei Tage nach dem Start in GitHub Copilot
-
ChatGPT kann jetzt beobachten, was du auf deinem Mac tust, wenn du es erlaubst
-
Qwen3.8-27B ist da und läuft auf einer einzigen Gaming-Grafikkarte
-
Deepseek verschenkte am selben Tag seine Agentensoftware und erhöhte die API-Preise
-
Das beste Modell auf dem Markt ist das, das die Unternehmen nicht kaufen
-
Googles Gemini 3.7 Flash ist besser im Code und kostet halb so viel
-
Ling 3.0 Flash ist das intelligenteste offene Modell seiner Größe und hat aufgehört, Dinge zu erfinden
-
Der neue Ultrafast-Modus von OpenAI führt sein bestes Modell 14-mal schneller aus
-
Someone Else Is Paying for Your AI, Just Not the Part You Think
-
Der Rocky-Linux-Gründer will den einzigen Teil der KI öffnen, den niemand öffnet: die Trainingsdaten
-
Stop Asking Whether AI Is a Bubble. Start Reading the Lease Agreements.
-
Dieser Rat, in welcher Sprache KI-Codes am besten sind? Bei echter Arbeit scheitert es
-
Nvidias neues kostenloses Modell ist nicht das intelligenteste. Es ist einfach sehr, sehr schnell
-
Meta hat ein 30B-Modell auf Ihren Laptop geladen und Zuckerberg nutzte die Markteinführung, um einen Kampf anzuzetteln
-
OpenAI fügt dem ChatGPT-Geschäft einen 125-Dollar-Sitz hinzu, da Agenten weit mehr essen als Chat
-
Google hat aus einem fertigen Modell ein viel schnelleres gemacht und das Rezept veröffentlicht
-
Ein Klimaforscher protokollierte acht Wochen lang den Einsatz von KI-Agenten. Pro Eingabeaufforderung wurde 600-mal mehr Strom verbraucht als bei einer Chat-Nachricht
-
Claude Code aktiviert standardmäßig den automatischen Modus und die Sicherheitszahlen entsprechen nicht Ihren Erwartungen
-
AMD kauft Taalas, ein Startup, das ein komplettes KI-Modell in den Chip integriert
-
Alibabas neuestes Modell schneidet besser ab und vermutet mehr: Halluzinationsrate steigt von 23 auf 40 Prozent
-
Forscher fragten, warum Chatbots bei Tabellenkalkulationen schlecht sind, und die Antwort ist seltsamer als erwartet
-
Mistral hat einen kostenlosen Sicherheitsfilter herausgebracht, den Sie im Klartext beschreiben und der auf eine Grafikkarte passt
-
Ein 80-Milliarden-Parameter-Modell läuft jetzt auf einem normalen Mac mit 4,3 GB Speicher und ein 35-B-Modell läuft auf einem iPhone
-
Karpathy verwandelte einen Absatz von Tolkien für zehn Dollar in eine 3D-Szene und nannte es einen Vibe Check
-
Alibabas Qwen3.8-Max hat 16 Tage damit verbracht, ein eigenes Tool zu schreiben, und die Gewichte werden nächste Woche veröffentlicht
-
Forscher gaben einem KI-Agenten ein echtes Unternehmen, eine Bankkarte und 24 Stunden. Er verlor 447 Dollar
-
Meta gab seinem KI-Agenten einen zweiten Agenten, dessen einzige Aufgabe das Erinnern ist
-
Mit einem einzigen Prompt entstehen spielbare 3D-Games, und sie sehen nicht mehr wie Bauklötze aus
-
AMD trainiert ein vollständig offenes Modell auf eigenen Chips, nur die kommerzielle Lizenz fehlt
-
OpenAI nennt seine nächste Modellfamilie Astra, und stellt sie mit zehn gelösten Mathematikproblemen vor
-
DeepSeek verbessert sein günstiges Modell und zieht mit OpenAIs Budgetmodell gleich
-
Mira Muratis Labor schrumpft sein Modell auf ein Viertel und verliert nur einen Punkt
-
OpenAI senkt den Preis von GPT-5.6 Luna um 80 Prozent und verschärft den KI-Preiskampf
-
So beantwortet ein 100-seitiges PDF deine Fragen, und so prüfst du, ob die Antworten erfunden sind
-
Anthropic: Claude entdeckt echte Schwächen in zwei Verschlüsselungsverfahren
-
Wir haben lokale KI auf einem sechs Jahre alten Billig-Laptop getestet. Das konnte sie wirklich.
-
Die Gewichte von Kimi K3 sind endlich öffentlich, und 1,4 Terabyte schwer
-
Cursor baute SQLite mit einem Agentenschwarm nach, und günstige Modelle erledigten den Großteil
-
Derselbe Berg KI-Ausgabe: 50 US-Dollar bei Anthropic, 87 Cent bei DeepSeek
-
Sakana sagt, sein Modell-Router schlägt jetzt ein Modell, das er gar nicht nutzt
-
Anthropics Opus 5 ist kleiner und günstiger, und schlägt trotzdem sein größeres Geschwistermodell
-
AMD und Cerebras tun sich zusammen, damit KI-Antworten schneller erscheinen
-
DeepSeek V4 ist vollständig stabil, die alten Modelle werden heute abgeschaltet
-
Google veröffentlicht drei neue Gemini-Modelle, alle schnell und günstig, und lässt das erwartete Modell aus
-
Alibabas neue Bild-KI zeichnet ganze Zeitungsseiten, inklusive winziger lesbarer Schrift
-
Nvidias nächste KI-Chips holen Berichten zufolge zehnmal mehr Arbeit aus derselben Energie
-
Alibaba zeigt Qwen3.8 Max vorab und will die Gewichte verschenken
-
OpenAI pausierte sein bestes Modell, weil es wiederholt aus seinem eigenen Testkäfig ausbrach
-
Kimi K3: Ein kostenlos herunterladbares Modell, das fast mit den großen Namen mithält
-
Anthropic hält Fable 5 für Abonnenten etwas länger kostenlos, dank des Preiskriegs
-
Unabhängige Zahlen liegen vor: Metas Muse Spark 1.1 ist eine ernsthafte Preis-Leistungs-Wahl
-
OpenAI räumt ein, dass der große Arbeitsstart stolperte, das wird jetzt korrigiert
-
OpenAI sagt, GPT-5.6 Sol habe seinen eigenen kleineren Bruder trainiert
-
GPT-5.6 Sol erreicht beinahe das beste KI-Modell, für ein Drittel des Preises
-
Meta steigt mit Muse Spark 1.1 und seiner ersten Entwickler-API in den KI-Preiskampf ein
-
Anthropics Antwort auf den Preis von Fable 5: Das Modell soll günstigere Modelle steuern
-
Grok 4.5 kommt zum Drittel des Preises, und das könnte wichtiger sein als Benchmarks
-
MiniMax plant Berichten zufolge ein Open-Source-Modell mit 2,7 Billionen Parametern
-
OpenAIs GPT-5.6-Modelle starten diesen Donnerstag öffentlich
-
Baidus „Unlimited OCR“ liest 40-seitige Dokumente in einem Durchgang, indem es zu vergessen lernt
-
Dieses Open-Source-Werkzeug versteckt Text in Bildern und senkt Claudes Kosten um bis zu 70 Prozent
-
Das KI-Werkzeug, das vor sechs Monaten „gescheitert“ ist? Vielleicht brauchte es einfach mehr Zeit
-
Tesla begrenzt die KI-Ausgaben seiner Mitarbeiter auf 200 Dollar pro Woche, ein Zeichen für eine Rechnung, mit der niemand gerechnet hatte
-
MiniMax M3: Ein Spitzenmodell der KI, das du herunterladen und selbst betreiben kannst
-
Kostenloser Geschwindigkeitsschub: Ollama macht lokale KI auf Macs bis zu 90 Prozent schneller