Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

blog+1digitaltrends+1blog+1Google Alphabet Inc. hat am Donnerstag Gemini Omni 1.1 Flash vorgestellt, ein Update seines generativen Videomodells, das Szenenerweiterung, Keyframe-basierte Übergänge, einen schnelleren Entwurfsmodus und 4K-Upscaling hinzufügt. Diese Werkzeuge sollen KI-generierte Videos für professionelle Produktionsabläufe praxistauglich machen.
Das Hauptmerkmal ist ein überarbeitetes System zur Szenenerweiterung. Während frühere Modelle bei der Generierung neuer Inhalte nur die letzte Sekunde des Materials berücksichtigten, analysiert Omni 1.1 bis zu 10 Sekunden an vorherigem Videokontext. Laut Google verbessert dies die visuelle Konsistenz und die narrative Kontinuität. Entwickler können Clips in 10-Sekunden-Schritten auf insgesamt bis zu 40 Sekunden verlängern, was, wie Digital Trends anmerkte, genug Raum für "einen echten Anfang, Mittelteil und Schluss" bietet.blog+1
Eine neue Steuerung für das erste und letzte Bild ermöglicht es Kreativen, zwei Keyframes festzulegen, zwischen denen das Modell eine kontinuierliche Bewegung generiert. Google positioniert diese Funktion für Kamerafahrten, Zoom-Übergänge und nahtlose Loop-Clips.firstpost+1
Omni 1.1 führt einen 360p-Entwurfsmodus ein, der laut Google bis zu 60 Prozent schneller rendert und nur ein Drittel der Kosten der Standardausgabe in 720p verursacht. Der beabsichtigte Arbeitsablauf ist klar: Günstige Prototypen in niedriger Auflösung erstellen und dann eine freigegebene Aufnahme für die finale Auslieferung auf 1080p oder 4K hochskalieren.sqmagazine+1
SQ Magazine berichtete, dass die Gemini API die Videoausgabe des Modells mit 17,50 Dollar pro Million Token bepreist, was etwa 0,10 Dollar pro Sekunde 720p-Material entspricht, obwohl Google keine separaten Preise für 4K- oder 360p-Ausgaben veröffentlicht hat. Entwickler können zudem bis zu drei Sekunden bestehendes Video als multimodale Referenz bereitstellen, um die Konsistenz von Charakteren und Umgebungen über Generationen hinweg zu wahren.blog+2
Das Modell ist ab sofort für Entwickler über Google AI Studio und die Gemini Enterprise Agent Platform verfügbar. Der Zugang für Endnutzer wird weltweit für Google AI Plus, Pro und Ultra-Abonnenten über Google Flow ausgerollt, wobei die Szenenerweiterung auch in der Gemini-App verfügbar ist.blog+1
Mehrere Unternehmen integrieren Omni Flash bereits in ihre Produkte. Adobe hat es in Firefly eingebunden, und der Creative Director von Figma, Itay Schiff, sagte, das Modell erlaube es Teams, "über das Generieren von Videos hinauszugehen und sie wirklich zu inszenieren". Der Chief Creative Officer von Runway, Jamie Umpherson, nannte es "einen weiteren Weg für unsere Nutzer, sich schnell zwischen Ideen zu bewegen".blog
Mit dieser Veröffentlichung stellt Google seine entwicklerorientierten Videowerkzeuge in direkten Wettbewerb mit OpenAIs Sora auf der Konsumentenseite, während sich der Bereich der generativen Videos zunehmend um Modelle konsolidiert, die neben der visuellen Qualität auch die Steuerbarkeit priorisieren.sqmagazine