Gemini Omni 1.1 Flash: Neue Kontrollfunktionen für Entwickler

AI generated

Google erweitert seine Omni-Modellreihe mit Gemini Omni 1.1 Flash. Die neue Version richtet sich gezielt an Entwickler und bietet erweiterte Steuerungsmöglichkeiten für generative Videos. Von der Verlängerung bestehender Szenen bis hin zur 4K-Auflösung bringt das Update wichtige Produktivfunktionen mit sich.

Das ist neu in Gemini Omni 1.1 Flash

Mit Gemini Omni 1.1 Flash stellt Google eine überarbeitete Version seines generativen Videomodells vor. Das Update macht das System produktionsreif für professionelle Anwendungen über die Gemini API in Google AI Studio. Entwickler profitieren von verbesserter Kontrolle über generative Videoprozesse, schnelleren Iterationszyklen und einer höheren Ausgabequalität für echte Workflows.

Szenen nahtlos verlängern

Eine der wichtigsten Neuerungen ist die Funktion zur Szenenerweiterung. Mit Omni 1.1 kann das Modell nun bis zu zehn Sekunden des vorherigen Kontexts analysieren, statt wie bisher nur die letzte Sekunde. Dies ermöglicht eine deutlich verbesserte visuelle Konsistenz und narrative Kohärenz. Entwickler können bestehende Videos in Zehn-Sekunden-Schritten verlängern, bis zu einer Gesamtlänge von 40 Sekunden.

Keyframe-Steuerung für gezielte Übergänge

Omni 1.1 erlaubt die Definition von Start- und Endframes für eine Aufnahme. Das Modell generiert dazwischen fließende Videosequenzen. Diese Funktion eignet sich besonders für komplexe Kameraorbits, Zoom-Übergänge oder nahtlose Loop-Clips.

Schnelle Entwürfe in 360p

Für die Prototypenentwicklung bietet Google eine 360p-Auflösung an. Diese ist bis zu 60 Prozent schneller und kostet nur ein Drittel im Vergleich zur Standard-720p-Auflösung. Die niedrigere Auflösung ist ideal für Storyboard-Iterationen und schnelle Rendering-Tests in Entwicklungsumgebungen.

Hochskalierung bis 4K

Nach der Freigabe eines Entwurfs können Entwickler Videos auf 1080p oder 4K hochskalieren. Die Ausgabequalität ist für professionelle Produktionen geeignet und reduziert den zusätzlichen Aufwand in der Postproduktion.

Videoreferenzen für konsistente Ergebnisse

Ein weiteres Feature ist die Möglichkeit, bis zu drei Sekunden Videomaterial als Referenz in den multimodalen Input einzubinden. So lässt sich der visuelle Kontext oder die Konsistenz von Figuren über mehrere Szenen hinweg gezielt aufrechterhalten.

Verfügbarkeit und Zugang

Gemini Omni 1.1 Flash ist ab sofort über das Google-Ökosystem verfügbar. Entwickler können das Modell direkt in Google AI Studio testen. Enterprise-Kunden greifen über die Agent Platform API zu. Zusätzlich bietet Google umfangreiche Dokumentationen, ein Cookbook und Prompting-Guides an.

Für Endanwender steht Omni 1.1 global für Abonnenten von Google AI Plus, Pro und Ultra in Google Flow bereit. Die Szenenerweiterung ist zudem in der Gemini App verfügbar.

Fazit

Mit Gemini Omni 1.1 Flash richtet Google sein generatives Videomodell stärker an professionelle Entwickler und Produktionsumgebungen aus. Die neuen Kontrollfunktionen, die effizientere Auflösung für Entwürfe und die Möglichkeit zur Hochskalierung auf 4K machen das Modell für reale Workflows nutzbar. Für Entwickler, die generative Videos in Tools und Software integrieren möchten, liefert das Update die nötige technische Grundlage.

Quelle: DeepMind Blog

Dieser Inhalt wurde mithilfe künstlicher Intelligenz erstellt.
Becker Julian