Bei KI-Videos entscheidet selten der erste Entwurf. Meist entsteht erst nach mehreren Varianten ein Clip, der Bildidee, Bewegung und Übergang halbwegs zusammenbringt. Google baut Gemini Omni 1.1 Flash nun genau um diesen Arbeitsablauf herum: erst günstige Entwürfe, dann gezielte Steuerung und erst am Ende eine höhere Ausgabeauflösung.
Das Wichtigste in 30 Sekunden
- Fest steht: Google dokumentiert für Gemini Omni 1.1 Flash 360p-Entwürfe, Szenenverlängerung, Start- und Endbilder, kurze Videoreferenzen sowie Ausgaben bis 4K.
- Offen bleibt: Es gibt keinen unabhängigen, reproduzierbaren Test zur Stabilität von Figuren, Bewegungen oder Texten im fertigen Clip.
- Relevant ist: Der Nutzen liegt eher in einem planbareren Produktionsablauf als in einem pauschalen Qualitätsversprechen.

Von der Einzelidee zum Arbeitsablauf
Google hat Gemini Omni 1.1 Flash am 27. August vorgestellt. Neu ist nicht einfach eine weitere Auflösungsstufe. Die dokumentierten Funktionen lassen sich zu einem Ablauf verbinden, der für Kreativteams und Entwickler praktischer sein kann als das wiederholte Neugenerieren eines ganzen Clips.
Eine Idee kann zunächst in 360p entstehen. Danach lässt sich eine brauchbare Variante auswählen, mit einem Start- und Endbild oder mit kurzem Referenzmaterial stärker eingrenzen und schrittweise verlängern. Erst wenn Bildsprache und Grundbewegung passen, folgt 720p, 1080p oder eine Ausgabe bis 4K. Das ist die belastbare Lesart der Ankündigung: mehr Kontrolle zwischen Entwurf und finalem Render, nicht der Nachweis einer fehlerfreien Videoproduktion.
360p ist vor allem eine Entwurfsstufe
Google bewirbt die 360p-Ausgabe als bis zu 60 Prozent schneller und mit einem Drittel der Kosten einer 720p-Ausgabe. Das ist eine Herstellerangabe; sie beruht auf einem Systemdurchsatzvergleich und ist keine Zusage für jede Auslastung, Region oder jedes Konto.
Für die Praxis ist die Richtung dennoch nachvollziehbar. Wer mehrere Einstellungen, Übergänge oder Bildideen vergleichen will, muss nicht jede Variante in hoher Auflösung bezahlen. Ob daraus ein günstiger fertiger Clip wird, hängt allerdings von den verworfenen Entwürfen, weiteren Bearbeitungsschritten und Verlängerungen ab. Die Preisgrafik beschreibt Sekundenpreise, keine Projektkalkulation.
| Ausgabe | Listenpreis laut Google |
|---|---|
| 360p | 0,03 US-Dollar pro Sekunde |
| 720p | 0,10 US-Dollar pro Sekunde |
| 1080p | 0,15 US-Dollar pro Sekunde |
| 4K | 0,30 US-Dollar pro Sekunde |
Steuern, Abrechnungsweg und konkrete Produktbedingungen können davon abweichen. In der Google-Cloud-Modellkarte steht zudem Fixed Quota statt Pay-as-you-go; die Zugangs- und Kostenfrage lässt sich deshalb nicht ohne Blick auf die verwendete Oberfläche beantworten.

Verlängerung ist kein 40-Sekunden-Prompt
Bei der Szenenverlängerung kann das Modell laut Google bis zu zehn Sekunden des vorherigen Videokontexts berücksichtigen. Verlängert wird in Schritten von jeweils zehn Sekunden; mehrere Schritte können sich auf bis zu 40 Sekunden summieren.
Die Unterscheidung ist wichtig. Google beschreibt damit eine kumulierte Workflow-Grenze, keinen einzelnen Auftrag für einen 40 Sekunden langen Clip. Jede Verlängerung ist ein weiterer Generierungsschritt. Die angegebene Endlänge sagt daher weder etwas über die durchgehende Konsistenz aus noch über die Kosten, die bis dorthin entstehen.
Start- und Endbild geben einen Rahmen vor
Mit einem ersten und einem letzten Bild lässt sich ein Übergang vorgeben, den das Modell dazwischen erzeugen soll. Google nennt dafür etwa Kamerafahrten, Zooms und Schleifen. Kurze Referenzvideos können zusätzlich visuellen Kontext liefern; der Launchpost nennt bis zu drei Sekunden, die Cloud-Modellkarte bis zu drei Videos pro Prompt und maximal zehn Sekunden je Eingabevideo.
Das erweitert die Steuerungsmöglichkeiten, ersetzt aber keine Sichtprüfung. Ein vorgegebenes Bildpaar kann einen Übergang besser eingrenzen. Es garantiert nicht, dass Figuren, Objekte oder Bewegungen in jeder Zwischenphase stabil bleiben oder dass eine beabsichtigte Kamerabewegung exakt getroffen wird.
4K ist eine Ausgabe, kein Qualitätsurteil
Google nennt für Gemini Omni 1.1 Flash Ausgaben bis 1080p und 4K. Die 4K-Funktion wird dabei als Upscaling beschrieben. Wer einen scharfen Export braucht, kann das nützlich finden. Daraus folgt jedoch keine native 4K-Erzeugung und auch kein Beleg für detailstabile, filmreife Ergebnisse.
Gerade deshalb ergibt der Ablauf aus kleinen Entwürfen und späterer Ausgabe Sinn: Qualität sollte vor dem Upscaling am Motiv, an Figuren, Bewegungen, Texten und dem gewünschten Übergang geprüft werden. Höhere Pixelzahl korrigiert keine inhaltlichen oder visuellen Fehler.

API und Cloud beschreiben den Status nicht gleich
Die aktuelle Gemini-API-Release-Note führt gemini-omni-1.1-flash als allgemein verfügbaren Endpunkt. Die Google-Cloud-Modellkarte nennt parallel gemini-omni-1.1-flash-preview und den Status Preview. Das muss kein Widerspruch im technischen Funktionsumfang sein, zeigt aber, dass Status, Abrechnung und Zugangsweg nicht über alle Oberflächen hinweg gleich dokumentiert sind.
Für Nutzer in Deutschland und im EWR ist diese Unterscheidung praktisch. Die Cloud-Karte nennt eine globale Region, Google spricht beim Flow-Rollout von weltweiter Verfügbarkeit für bestimmte Abos. Eine ältere allgemeine API-Anleitung schließt dagegen die Bearbeitung hochgeladener Videos im EWR, in der Schweiz und im Vereinigten Königreich aus. Diese Seite stammt vom 30. Juli und damit vor dem 1.1-Release. Sie belegt keine aktuelle Sperre für jeden neuen Weg, macht aber eine konkrete Verfügbarkeitsprüfung sinnvoll.
Der entscheidende Nachweis fehlt noch
Google und mehrere unabhängige Berichte beschreiben Funktionsumfang, Dauergrenzen und Preisstufen. Einen aktuellen, reproduzierbaren Vergleich dazu, wie zuverlässig Szenenverlängerung, Start-/Endbild-Interpolation oder Referenzvideo im Alltag funktionieren, liefert das Dossier nicht. Auch ein eigener Render wurde für diesen Artikel nicht durchgeführt.
Das begrenzt die Bewertung, ohne die Ankündigung kleinzureden. Der neue 1.1-Stand macht den Ablauf plausibler: Varianten günstig prüfen, eine Richtung auswählen, Übergänge gezielter rahmen und erst danach höher ausgeben. Ob daraus in realen Produktionen weniger Ausschuss und stabilere Clips entstehen, müssen praktische Tests zeigen. Bis dahin ist Gemini Omni 1.1 Flash vor allem ein Werkzeug für einen stärker gegliederten Produktionsprozess.
Quellen und weiterführende Informationen
- Google DeepMind: Gemini Omni 1.1 Flash lets you build with more control (27.08.2026)
- Google AI for Developers: Gemini API Release Notes
- Google Cloud: Gemini Omni 1.1 Flash Preview-Modellkarte
- Google AI for Developers: Generate and edit videos with Gemini Omni Flash
- The Decoder: Einordnung zu Preis und Funktionsumfang
- Neowin: Einordnung zu Verlängerung und Upscaling
Hinweis: Für diesen Artikel wurden KI-gestützte Recherche- und Editierwerkzeuge verwendet. Der Inhalt wurde redaktionell geprüft. Stand: 2026-08-29.