Gemini Omni Flash: Googles konversationsbaserede AI-videomodel
Gemini Omni Flash er Googles modelfamilie til hurtig konversationsbaseret videogenerering og -redigering, med video som det dokumenterede API-output.
Hvad er Gemini Omni Flash?
Gemini Omni Flash er en Google AI-modelfamilie bygget til hurtig konversationsbaseret videogenerering og -redigering. Googles Gemini API-dokumentation identificerer Gemini Omni 1.1 Flash som den nuværende stabile API-model og oplister video som API-outputmodalitet. Gemini Omni Flash API'et kan arbejde ud fra tekst, billeder eller understøttede videoinput. Google dokumenterer workflows til at oprette en video fra en prompt, animere et billede, redigere eller udvide et uploadet klip og forfine et resultat gennem en stateful interaktion. Dette er en uafhængig modelguide. Story321 hævder ikke, at Gemini Omni Flash driver Story321s videoværktøjer.
Dokumenterede funktioner
Tekst til video
Opret en video fra en tekstprompt via den Gemini API-workflow, som Google dokumenterer.
Billede til video
Brug et billede som udgangspunkt for et animeret videoresultat.
Konversationsbaseret redigering
Brug Interactions API'et og et tidligere interaktions-ID til at fortsætte med at forfine et tidligere resultat.
Videoredigering og -forlængelse
Google dokumenterer redigering af uploadede videoer og tilføjelse af en forlængelse til et godkendt klip.
Frame-interpolation
Generér en overgangsvideo ud fra angivne første og sidste frames.
Flere outputmuligheder
Den officielle dokumentation oplister 360p, 720p, 1080p og 4K outputmuligheder, afhængigt af den valgte workflow og tilgængelighed.
Aktuelle API-fakta
| Features | Gemini Omni Flash |
|---|---|
Stabil API-model | gemini-omni-1.1-flash |
Preview API-model | gemini-omni-flash-preview |
Dokumenteret input | Tekst, billede og video; uploadet video til redigering eller forlængelse er begrænset til godkendte klip på op til 10 sekunder. |
Dokumenteret output | Video |
Dokumenteret videovarighed | 3 til 10 sekunder |
Dokumenteret billedhastighed | 24 FPS |
Dokumenteret kontekstvindue | 1.048.576 tokens |
Hvor det kan passe ind
Prompt-styrede korte klip
Prototypér korte videokoncepter ud fra en skrevet scene, handling eller visuel retning.
Animation af stillbilleder
Forvandl et angivet billede til en kort animeret optagelse, når en billed-til-video-workflow er passende.
Iterativ videostyring
Fortsæt en samtale om et genereret resultat i stedet for at starte hver redigering fra bunden.
Revidering af korte klip
Redigér et godkendt uploadet klip eller tilføj en fortsættelse, når den officielle workflow understøtter det.
Adgang og tilgængelighed
Google dokumenterer Gemini Omni Flash i Gemini API'et og tilbyder et AI Studio-indgangspunkt for Gemini Omni 1.1 Flash. Tjek Googles aktuelle dokumentation, før du bygger en workflow, fordi modelidentifikatorer, regional tilgængelighed og understøttede funktioner kan ændre sig. Modelnavnet kan henvise til den bredere Gemini Omni-familie i Googles materialer, mens Gemini Omni 1.1 Flash er den stabile API-model, der nævnes i den aktuelle modeldokumentation.
Vigtige begrænsninger
Documented limitation
Google oplister begrænsninger for nogle redigerings- og forlængelsesworkflows efter region, herunder EØS, Schweiz og Storbritannien.
Documented limitation
Redigering og forlængelse af uploadede videoer er begrænset til understøttede klip på op til 10 sekunder; forlængelse tilføjes til slutningen af en video.
Documented limitation
Googles aktuelle API-guide oplister stemmeredigering, lydreferencer og multi-video-workflows som ikke-understøttet eller ikke-tilgængeligt i den beskrevne workflow.
Documented limitation
Gemini Omni Flash-modelkortet bemærker begrænsninger omkring redigeringskonsistens, kompleks bevægelse og præcis tekstgengivelse.
Officielle kilder
Gemini Omni Flash modeldokumentation
Googles modelside oplister de stabile og preview API-modelidentifikatorer, dokumenterede modaliteter, varighed, opløsninger, billedhastighed og kontekstvindue.
Google AI for DevelopersGemini Omni API-guide
Googles workflow-guide dækker tekst-til-video, billede-til-video, stateful redigering, frame-interpolation, videoredigering, forlængelse og aktuelle begrænsninger.
Google AI for DevelopersGemini Omni Flash-modelkort
Google DeepMinds modelkort beskriver tilsigtet brug og offentliggjorte begrænsninger, herunder udfordringer med konsistens, bevægelse og tekstgengivelse.
Google DeepMindGemini Omni-oversigt
Google DeepMinds oversigt beskriver Gemini Omni som en model til at oprette og redigere videoer med konversationsbaseret styring.
Google DeepMindOfte stillede spørgsmål om Gemini Omni Flash
Er Gemini Omni Flash en tekst-til-video-model?
Google dokumenterer en tekst-til-video-workflow for Gemini Omni Flash. Dens aktuelle modelside oplister tekst-, billed- og videoinput med videooutput i API'et.
Hvad er den stabile Gemini Omni Flash API-model?
Googles aktuelle modeldokumentation oplister gemini-omni-1.1-flash som den stabile API-model og gemini-omni-flash-preview som en preview-model.
Kan Gemini Omni Flash redigere video?
Google dokumenterer redigering og forlængelse af understøttede uploadede klip, samt stateful samtalebaseret forfining. Tilgængeligheds- og workflowbegrænsninger gælder.
Bruger Story321 Gemini Omni Flash?
Denne side er en informativ modelguide. Den angiver ikke, at Gemini Omni Flash driver Story321s videoværktøjer.
Udforsk videoworkflows på Story321
Tekst til video
Opret korte videoer fra en skrevet prompt.
Åbn Tekst til videoBillede til video
Start en videoworkflow ud fra et billede.
Åbn Billede til videoAI-videoeditor
Udforsk Story321s videoredigeringsarbejdsområde.
Åbn AI-videoeditorForlæng video
Fortsæt en video med Story321s forlængelsesworkflow.
Åbn Forlæng videoVælg den rigtige videoworkflow
Brug Story321s videoværktøjer til dit projekt, eller gennemgå Googles officielle dokumentation, når du vurderer selve Gemini Omni Flash.
Modeloplysninger er baseret på de linkede officielle kilder og kan ændre sig, når Google opdaterer API'et.