Googles Gemini 3.8 Flash behält den alten Preis und bringt einen Cyber Twin mit
Google DeepMind veröffentlichte Gemini 3.8 Flash am 2. September für 0,75 US-Dollar pro Million Eingabetoken, unverändert gegenüber 3.7 Flash. Eine separate Cyber-Variante zum Auffinden und Patchen von Schwachstellen steht nur geprüften Verteidigern zur Verfügung.
Google DeepMind hat letzten Mittwoch Gemini 3.8 Flash veröffentlicht, die dritte Flash-Version innerhalb von sechs Wochen. Die Aussage ist ungewöhnlich klar: die gleiche Geschwindigkeit und der gleiche Preis wie 3.7 Flash, mit besserer Argumentation und Codierung. Der Input kostet 0,75 US-Dollar pro Million Token, der Output 3,75 US-Dollar, und das ist ein Einführungspreis, der am 31. Dezember 2026 ausläuft. Ab dem 1. Januar verdoppeln sich diese Zahlen auf 1,50 US-Dollar und 7,50 US-Dollar.
Google meldet Fortschritte bei der langfristigen Softwareentwicklung, also bei Aufgaben, bei denen ein Modell ein Problem über viele Schritte hinweg bearbeiten muss, anstatt es auf einmal zu beantworten. Bei HLE-Verified, einem harten Test zum logischen Denken mit mehreren Themen, erreicht es 54,9 %, und laut Google schlägt 3,8 Flash größere und teurere Modelle auf DeepSWE v1.1. In Googles eigenem Beitrag gibt es einen ehrlichen Vorbehalt: 3.8 Flash „arbeitet härter“, führt zusätzliche Argumentationsschritte aus und ruft Tools wiederholt auf, was bedeutet, dass bei derselben Aufgabe mehr Token verbrannt werden können als 3.7 Flash. Google fordert Entwickler, denen die Kosten am meisten am Herzen liegen, ausdrücklich dazu auf, bei 3.7 Flash zu bleiben oder den Aufwand zu reduzieren.
Das zweite Modell ist das interessante. Gemini 3.8 Flash Cyber ist darauf ausgelegt, Software-Schwachstellen zu finden und Patches dafür zu schreiben, und ist nicht allgemein verfügbar. Der Zugang erfolgt über ein neues Fairwind-Programm, das sich an Regierungsbehörden, Betreiber kritischer Infrastrukturen und Software-Betreuer richtet. Google gibt an, der Behebung von Fehlern bewusst Vorrang vor deren Ausnutzung gegeben zu haben. Einige konkrete Ergebnisse: Das Sicherheitsteam von Chrome meldete 2,6-mal mehr korrekte Patches als bei viel größeren kommerziellen Modellen, und das Cloud-Schwachstellenteam von Google gab an, in weniger als zwei Stunden einen kritischen grundlegenden Fehler gefunden zu haben, eine Arbeit, die normalerweise Monate dauern würde. Im CWE-Bench, einem externen Patching-Benchmark, erreicht es 47,2 % gegenüber 47,8 % eines führenden Grenzmodells, und das zu einem Bruchteil der Kosten.
Das Muster hinter der Aufteilung. Zwei Labore in zwei Tagen haben jetzt ein öffentliches Modell und ein geschlossenes Cyber-Geschwistermodell ausgeliefert. Der Grund dafür ist, dass dieselbe Fähigkeit in beide Richtungen funktioniert: Ein Modell, das gut genug ist, um die Lücke in Ihrem Code zu finden, ist gut genug, um die Lücke im Code eines anderen zu finden. Anstatt zu wählen, ob sie es an alle oder an niemanden verschicken möchten, haben beide Unternehmen mit einem Antragsformular eine mittlere Ebene geschaffen. Google meldet auch einen starken Anstieg des Widerstands gegen die Prompt-Injection, den Trick, bei dem in einer Webseite oder einem Dokument versteckte Anweisungen ein Modell kapern, das sie liest. Dies ist wohl die nützlichere Sicherheitsverbesserung für normale Benutzer, da die sofortige Injektion der Fehlermodus ist, auf den Sie am wahrscheinlichsten stoßen.
Was das für Sie bedeutet. Wenn Sie die Gemini-App mit einem Pro- oder Ultra-Plan verwenden, ist 3.8 Flash bereits vorhanden und im AI-Modus in der Suche und in Google Sheets. Bei den meisten alltäglichen Fragen werden Sie es nicht bemerken. Wenn Sie mit der API erstellen, beachten Sie den Kalender: Der Preis, für den Sie sich heute anmelden, verdoppelt sich im Januar, planen Sie also eher für 2027 als für den aktuellen Wert ein. Und wenn Sie eine Infrastruktur betreiben, auf die die Menschen angewiesen sind, ist das Fairwind-Programm offen für Bewerbungen, eine wirklich neue Option, die es vor einem Jahr noch nicht gab.
Quellen
OpenAI liefert GPT-6 Astra aus und nennt es sein erstes kritisches Cyber-Modell
OpenAI veröffentlichte GPT-6 Astra am 3. September mit einem 1,1-Millionen-Token-Kontextfenster bei 10 US-Dollar pro Million Eingabe-Tokens und 50 US-Dollar pro Million Ausgabe. Es ist das erste Modell, von dem das Unternehmen sagt, dass es seinen kritischen Cybersicherheitsgrenzwert erreicht.