Veo ist ein generatives KI-Modell zur Videoerzeugung, das aus sprachlichen Anweisungen hochwertige Bewegtbilder erzeugen kann. Die aktuelle Modellgeneration wird von Google DeepMind als besonders realistisch, steuerbar und in der Promptumsetzung präzise beschrieben.
Mit Veo baut Google seine Modellfamilie über Text und Bild hinaus in Richtung Video aus. Das Modell ist vor allem für kreative Produktion, Marketing, Storytelling und visuelle Medienformate relevant, bei denen aus kurzen Beschreibungen bewegte Szenen entstehen sollen.
Google beschreibt Veo 3 als Modell mit erweiterten kreativen Steuerungsmöglichkeiten, nativer Audiofunktion und längeren Videosequenzen. Damit entwickelt sich Veo von reiner Videogenerierung zunehmend zu einem umfassenderen System für audiovisuelle Inhalte.