Modell-Guide

Gemini Omni Flash: Googles konversationelles KI-Videomodell

Gemini Omni Flash ist Googles Modellfamilie für schnelle konversationelle Videogenerierung und -bearbeitung, mit Video als dokumentierter API-Ausgabe.

Text zu Video
Bild zu Video
Videobearbeitung

Was ist Gemini Omni Flash?

Gemini Omni Flash ist eine Google-KI-Modellfamilie, die für schnelle konversationelle Videogenerierung und -bearbeitung entwickelt wurde. Googles Gemini-API-Dokumentation identifiziert Gemini Omni 1.1 Flash als aktuelles stabiles API-Modell und listet Video als API-Ausgabemodalität auf. Die Gemini Omni Flash API kann mit Text, Bildern oder unterstützten Videoeingaben arbeiten. Google dokumentiert Workflows zum Erstellen eines Videos aus einem Prompt, Animieren eines Bildes, Bearbeiten oder Erweitern eines hochgeladenen Clips sowie zur Verfeinerung eines Ergebnisses durch eine zustandsbehaftete Interaktion. Dies ist ein unabhängiger Modell-Guide. Story321 behauptet nicht, dass Gemini Omni Flash seine Videotools betreibt.

Dokumentierte Funktionen

Text-zu-Video

Erstellen Sie ein Video aus einem Textprompt über den von Google dokumentierten Gemini-API-Workflow.

Bild-zu-Video

Verwenden Sie ein Bild als Ausgangspunkt für ein animiertes Videoergebnis.

Konversationelle Bearbeitung

Nutzen Sie die Interactions-API und eine vorherige Interaktions-ID, um ein früheres Ergebnis weiter zu verfeinern.

Videobearbeitung und -erweiterung

Google dokumentiert die Bearbeitung hochgeladener Videos und das Anhängen einer Erweiterung an einen qualifizierten Clip.

Frame-Interpolation

Generieren Sie ein Übergangsvideo aus bereitgestellten ersten und letzten Frames.

Mehrere Ausgabeoptionen

Die offizielle Dokumentation listet 360p, 720p, 1080p und 4K als Ausgabeoptionen, abhängig vom ausgewählten Workflow und der Verfügbarkeit.

Aktuelle API-Fakten

Features
Gemini Omni Flash
Stabiles API-Modell
gemini-omni-1.1-flash
Preview-API-Modell
gemini-omni-flash-preview
Dokumentierte Eingabe
Text, Bild und Video; hochgeladenes Video für Bearbeitung oder Erweiterung ist auf qualifizierte Clips von bis zu 10 Sekunden begrenzt.
Dokumentierte Ausgabe
Video
Dokumentierte Videodauer
3 bis 10 Sekunden
Dokumentierte Bildrate
24 FPS
Dokumentierter Kontextfenster
1.048.576 Token

Wo es passt

Promptgeführte Kurzclips

Prototypisieren Sie kurze Videokonzepte aus einer geschriebenen Szene, Aktion oder visuellen Richtung.

Animierung von Standbildern

Verwandeln Sie ein bereitgestelltes Bild in einen kurzen bewegten Clip, wenn ein Bild-zu-Video-Workflow geeignet ist.

Iterative Videosteuerung

Setzen Sie ein Gespräch über ein generiertes Ergebnis fort, anstatt jede Bearbeitung von Grund auf zu beginnen.

Überarbeitung von Kurzclips

Bearbeiten Sie einen qualifizierten hochgeladenen Clip oder fügen Sie eine Fortsetzung an, wenn der offizielle Workflow dies unterstützt.

Zugriff und Verfügbarkeit

Google dokumentiert Gemini Omni Flash in der Gemini-API und bietet einen AI-Studio-Einstiegspunkt für Gemini Omni 1.1 Flash. Überprüfen Sie die aktuelle Google-Dokumentation, bevor Sie einen Workflow aufbauen, da Modellkennungen, regionale Verfügbarkeit und unterstützte Funktionen sich ändern können. Der Modellname kann sich in Google-Materialien auf die breitere Gemini-Omni-Familie beziehen, während Gemini Omni 1.1 Flash das stabile API-Modell ist, das in der aktuellen Modelldokumentation genannt wird.

Wichtige Einschränkungen

Documented limitation

Google listet Einschränkungen für einige Bearbeitungs- und Erweiterungs-Workflows nach Region auf, einschließlich EWR, Schweiz und Großbritannien.

Documented limitation

Videobearbeitung und -erweiterung bei hochgeladenen Videos sind auf unterstützte Clips von bis zu 10 Sekunden begrenzt; die Erweiterung wird an das Ende eines Videos angehängt.

Documented limitation

Google’s aktueller API-Leitfaden listet Sprachbearbeitung, Audio-Referenzen und Multi-Video-Workflows als nicht unterstützt oder im beschriebenen Workflow nicht verfügbar.

Documented limitation

Die Modellkarte von Gemini Omni Flash weist auf Einschränkungen bei Bearbeitungskonsistenz, komplexer Bewegung und genauer Textdarstellung hin.

Gemini Omni Flash FAQ

Ist Gemini Omni Flash ein Text-zu-Video-Modell?

Google dokumentiert einen Text-zu-Video-Workflow für Gemini Omni Flash. Die aktuelle Modellseite listet Text, Bild und Video als Eingabe mit Video als Ausgabe in der API auf.

Was ist das stabile Gemini Omni Flash API-Modell?

Googles aktuelle Modelldokumentation listet gemini-omni-1.1-flash als stabiles API-Modell und gemini-omni-flash-preview als Preview-Modell auf.

Kann Gemini Omni Flash Videos bearbeiten?

Google dokumentiert die Bearbeitung und Erweiterung unterstützter hochgeladener Clips sowie die zustandsbehaftete konversationelle Verfeinerung. Verfügbarkeits- und Workflow-Einschränkungen gelten.

Verwendet Story321 Gemini Omni Flash?

Diese Seite ist ein informativer Modell-Guide. Sie besagt nicht, dass Gemini Omni Flash die Story321-Videotools betreibt.

Wählen Sie den richtigen Video-Workflow

Nutzen Sie Story321s Videotools für Ihr Projekt oder lesen Sie Googles offizielle Dokumentation, wenn Sie Gemini Omni Flash selbst bewerten.

Modelldetails basieren auf den verlinkten offiziellen Quellen und können sich ändern, wenn Google die API aktualisiert.