Googles Gemini 3.7 Flash ist besser im Code und kostet halb so viel
Drei Wochen nach Gemini 3.6 Flash lieferte Google 3.7 Flash mit echten Programmiervorteilen aus und senkte den Einführungspreis um die Hälfte. Der Haken liegt im Kalender: Der Preis läuft am 31. Dezember aus.
Google hat Gemini 3.7 Flash am Donnerstag veröffentlicht, drei Wochen nach seinem Vorgänger, und es kommt mit zwei Schlagzeilen: Es kann deutlich besser Code schreiben und kostet die Hälfte dessen, was Gemini 3.6 Flash beim Start gekostet hat. Flash ist Googles Arbeitspferd-Reihe, das günstige und schnelle Modell, das eher für alltägliche als für die schwierigsten Aufgaben gedacht ist. Dies ist die bisher leistungsfähigste Version.
Bei den von Google veröffentlichten Zahlen geht es hauptsächlich um Codierung und Agenten. Bei FrontierCode 1.1, einem Test von Code in Produktionsqualität, erreicht das Modell 43,6 Prozent gegenüber 34,4 Prozent bei 3.6 Flash. Bei DeepSWE v1.1, das misst, ob ein Modell eine lange Softwareaufgabe bis zum Ende durchführen kann, ohne den Thread zu verlieren, steigt der Wert von 49,0 auf 65,3 Prozent. Seine Bewertung in der WebDev Arena, wo Menschen darüber abstimmen, welches Modell die bessere Webseite erstellt, stieg von 1538 auf 1588. Google meldet auch Fortschritte beim Dokumentenverständnis und bei der Automatisierung von Geschäftsprozessen und sagt, dass seine eigenen Messungen 3,7 Flash vor Claude Sonnet 5 und GPT-5,6 Terra liegen lassen. Das sind die Benchmarks von Google, also betrachten Sie sie als Ausgangspunkt und nicht als Urteil.
Bei der Preisgestaltung wird es interessant. Die Startraten liegen bei 0,75 US-Dollar pro Million Input-Tokens und 3,75 US-Dollar pro Million Output-Tokens, genau die Hälfte dessen, was 3.6 Flash zum Zeitpunkt seines Erscheinens kostete. Ein Token ist der Textblock, den ein Modell liest und schreibt, etwa drei Viertel eines Wortes. Dieser Preis gilt bis zum 31. Dezember 2026. Am 1. Januar verdoppelt er sich auf 1,50 $ und 7,50 $. Das Modell ist ab sofort über die API, AI Studio und Antigravity verfügbar.
Was ist hier eigentlich los?
Drei Wochen zwischen den Veröffentlichungen sind kein normaler Produktrhythmus, sondern ein Preiskampf mit Modellnummern. Auf der günstigen Stufe liegt das Volumen: Chatbots, Zusammenfassungen, Dokumentenverarbeitung, Codierungsassistenten, die im Hintergrund laufen. Wer in dieser Stufe pro nutzbarer Arbeitseinheit am günstigsten ist, erhält eine enorme Menge an Nutzung, daher kauft Google mit einem Einführungspreis Marktanteile und teilt Ihnen im Voraus mit, wann der Preis endet. Google führt den Leistungssprung auf „algorithmische Verbesserungen“ zurück, was plausibel, aber von außen nicht überprüfbar ist. Was wir überprüfen können, ist das Preisblatt, und auf dem Preisblatt steht: jetzt günstig, im Januar doppelt so teuer.
Was das für dich bedeutet: Wenn du nur die Gemini-App nutzt, ändert sich heute nichts. Dieses API-Produkt richtet sich an Menschen und Unternehmen, die Anwendungen entwickeln. Falls du etwas baust, solltest du nicht nur auf den Starttermin, sondern vor allem auf das zweite Datum achten. Eine App, deren Kalkulation auf dem Tarif von 0,75 Dollar beruht, kostet ab dem 1. Januar 2027 doppelt so viel im Betrieb. Das ist nah genug, um heutige Planungen zu beeinflussen. Wenn dein Programmierassistent eine Modellwahl erlaubt, lohnt sich ein Test von 3.7 Flash mit echten Aufgaben. Benchmarks sagen etwas aus, ein Nachmittag mit deiner eigenen Codebasis aber mehr.
Quellen
Ling 3.0 Flash ist das intelligenteste offene Modell seiner Größe und hat aufgehört, Dinge zu erfinden
InclusionAI der Ant Group hat Ling 3.0 Flash unter der MIT-Lizenz veröffentlicht. Die Hauptzahl ist nicht der Intelligenzwert, sondern die Halluzinationsrate, die von 97 auf 44 Prozent sinkt.