Imagen ist ein generatives KI-Modell zur Bilderzeugung. Nutzer beschreiben in Sprache, was sie sehen möchten, und das Modell erstellt daraus visuelle Inhalte mit hohem Detailgrad, unterschiedlichen Stilen und realistischer Darstellung. Die Imagen-4-Familie umfasst drei Varianten: das Hauptmodell, Imagen 4 Fast für schnelle und hochvolumige Aufgaben sowie Imagen 4 Ultra für maximale Qualität.
Imagen eignet sich vor allem für Design, Marketing, Content-Produktion und visuelle Konzeptarbeit. Das Modell unterstützt Ausgaben in hoher Auflösung und überzeugt besonders durch eine präzise Textwiedergabe – was es für Poster, Grafiken und Comics besonders nützlich macht.
Imagen ist der Bildbereich innerhalb der Google-Modellfamilien und ergänzt Systeme wie Gemini, Veo oder Lyria um die visuelle Generierung. Es ist über Dienste wie die Gemini App, ImageFX und Vertex AI verfügbar. Damit deckt Google nicht nur Text, sondern auch Bild, Video und Musik über spezialisierte Modelle ab.