Google Imagen
Googles Familie von Text-zu-Bild-Modellen, die nun in die allgemeine Gemini-Modellreihe integriert wird.
Imagen ist Googles Reihe von Text-zu-Bild-Modellen, die aus einer schriftlichen Beschreibung ein Bild erzeugen. Sie begann 2022 als Forschungsprojekt und wurde über Googles Entwicklerplattformen zu einem Produkt, das mit Midjourney, DALL-E und Stable Diffusion konkurriert. Erzeugte Bilder tragen SynthID, Googles unsichtbares Wasserzeichen für KI-generierte Medien.
Interessant ist Imagen heute vor allem als Beispiel dafür, wie schnell sich solche Schnittstellen verändern. Google legte den 17. August 2026 als frühestmöglichen Abschalttermin für drei Imagen-4-Modellkennungen fest und verweist Entwickler auf gemini-3.1-flash-image. Es ist keine einfache Umbenennung: Die eigene Methode generate_images() entfällt, Bilder werden nun über denselben generate_content()-Aufruf wie Text erzeugt. Das zeigt den Branchentrend zu einem einzigen multimodalen Modell je Familie statt eines Spezialendpunkts pro Aufgabe und erinnert daran, dass Modell-APIs eher die Lebensdauer eines Smartphone-Betriebssystems als die einer Datenbank haben.