Google stellt KI-Modell Gemini Omni 1.1 Flash für Videogenerierung vor
Google hat am 27. August das KI-Modell Gemini Omni 1.1 Flash vorgestellt, das Videos mit bis zu 4K-Auflösung erstellen kann. Das Modell bietet neue Funktionen zur Erweiterung und Bearbeitung von Videoinhalten.

Google hat am 27. August sein neues KI-Modell Gemini Omni 1.1 Flash vorgestellt, das für die Videogenerierung entwickelt wurde und Inhalte mit bis zu 4K-Auflösung erzeugen kann. Diese Veröffentlichung erweitert die künstlichen Intelligenzfähigkeiten des Unternehmens im Bereich der Medienerstellung.
Das Gemini Omni 1.1 Flash-Modell beinhaltet mehrere wichtige Verbesserungen. Nutzer können nun bestehende Videos nahtlos erweitern, indem sie nachfolgende Szenen hinzufügen, was eine kumulative Videolänge von bis zu 40 Sekunden ermöglicht. Das Modell erlaubt auch die Festlegung von Start- und Endbildern, was reibungslose Übergänge und kontrollierte Kamerabewegungen erleichtert.
Zusätzlich bietet das Modell eine schnellere und kostengünstigere Option zur Erstellung von Vorschauen. Die Erstellung von 360p-Vorschauen kann bis zu 60 % schneller erfolgen und kostet ein Drittel des Standardtarifs, was sich für schnelles Prototyping und Skriptiteration eignet. Es unterstützt auch die Verwendung von Referenzvideoclips bis zu drei Sekunden Länge, um die Konsistenz in Kontext und Charakter beizubehalten.
Die Preisgestaltung variiert je nach Auflösung: Die Generierung von 360p-Videos kostet 0,03 USD pro Sekunde, 720p 0,1 USD pro Sekunde, 1080p 0,15 USD pro Sekunde und 4K 0,3 USD pro Sekunde. Dieser Fortschritt positioniert Google, um im KI-gesteuerten Markt für Videoproduktion weiter zu konkurrieren.