Gemini Omni Flash: Googles samtalefokuserte AI-videomodell
Gemini Omni Flash er Googles modellfamilie for rask samtalegenerering og redigering av video, med video som dokumentert API-utdata.
Hva er Gemini Omni Flash?
Gemini Omni Flash er en Google AI-modellfamilie bygget for rask samtalegenerering og redigering av video. Googles Gemini API-dokumentasjon identifiserer Gemini Omni 1.1 Flash som den gjeldende stabile API-modellen og oppgir video som API-utdata-modus. Gemini Omni Flash API kan arbeide med tekst, bilder eller støttede videoinndata. Google dokumenterer arbeidsflyter for å lage en video fra en ledetekst, animere et bilde, redigere eller utvide en opplastet klipp, og forbedre et resultat gjennom en tilstandsbasert interaksjon. Dette er en uavhengig modellveiledning. Story321 hevder ikke at Gemini Omni Flash driver videoverktøyene deres.
Dokumenterte funksjoner
Tekst-til-video
Lag en video fra en tekstledetekst via Gemini API-arbeidsflyten dokumentert av Google.
Bilde-til-video
Bruk et bilde som utgangspunkt for et animert videoresultat.
Samtaleredigering
Bruk Interactions API og en tidligere interaksjons-ID for å fortsette å forbedre et tidligere resultat.
Videoredigering og utvidelse
Google dokumenterer redigering av opplastet video og muligheten til å legge til en utvidelse på et kvalifiserende klipp.
Bildeinterpolering
Generer en overgangsvideo fra oppgitte første og siste bilder.
Flere utdataalternativer
Offisiell dokumentasjon lister opp 360p, 720p, 1080p og 4K-utdataalternativer, avhengig av valgt arbeidsflyt og tilgjengelighet.
Gjeldende API-fakta
| Features | Gemini Omni Flash |
|---|---|
Stabil API-modell | gemini-omni-1.1-flash |
Forhåndsvisning API-modell | gemini-omni-flash-preview |
Dokumentert inndata | Tekst, bilde og video; opplastet video for redigering eller utvidelse er begrenset til kvalifiserende klipp på opptil 10 sekunder. |
Dokumentert utdata | Video |
Dokumentert varighet | 3 til 10 sekunder |
Dokumentert bildefrekvens | 24 FPS |
Dokumentert kontekstvindu | 1 048 576 tokens |
Hvor det kan passe inn
Korte klipp fra ledetekst
Prototype korte videokonsepter fra en skrevet scene, handling eller visuell retning.
Animering av stillbilder
Gjør et oppgitt bilde til et kort bevegelig opptak når en bilde-til-video-arbeidsflyt er passende.
Iterativ videostyring
Fortsett en samtale om et generert resultat i stedet for å starte hver redigering fra bunnen av.
Revisjon av korte klipp
Rediger et kvalifiserende opplastet klipp, eller legg til en fortsettelse når den offisielle arbeidsflyten støtter det.
Tilgang og tilgjengelighet
Google dokumenterer Gemini Omni Flash i Gemini API og tilbyr et AI Studio-inngangspunkt for Gemini Omni 1.1 Flash. Sjekk Googles gjeldende dokumentasjon før du bygger en arbeidsflyt, fordi modellidentifikatorer, regional tilgjengelighet og støttede funksjoner kan endres. Modellnavnet kan referere til den bredere Gemini Omni-familien i Googles materialer, mens Gemini Omni 1.1 Flash er den stabile API-modellen som er navngitt i den gjeldende modell-dokumentasjonen.
Viktige begrensninger
Documented limitation
Google oppgir begrensninger for noen redigerings- og utvidelsesworkflows per region, inkludert EØS, Sveits og Storbritannia.
Documented limitation
Redigering og utvidelse av opplastet video er begrenset til støttede klipp på opptil 10 sekunder; utvidelse legges til slutten av en video.
Documented limitation
Googles gjeldende API-guide oppgir taleredigering, lydreferanser og multi-video-workflows som ikke støttet eller tilgjengelig i den beskrevne arbeidsflyten.
Documented limitation
Gemini Omni Flash-modellkortet noterer begrensninger rundt redigeringskonsistens, kompleks bevegelse og nøyaktig tekstgjengivelse.
Offisielle kilder
Gemini Omni Flash modell-dokumentasjon
Googles modellside lister opp de stabile og forhåndsvisnings API-modellidentifikatorene, dokumenterte moduser, varighet, oppløsninger, bildefrekvens og kontekstvindu.
Google AI for utviklereGemini Omni API-veiledning
Googles arbeidsflytveiledning dekker tekst-til-video, bilde-til-video, tilstandsbasert redigering, bildeinterpolering, videoredigering, utvidelse og gjeldende begrensninger.
Google AI for utviklereGemini Omni Flash modellkort
Google DeepMinds modellkort beskriver tiltenkt bruk og publiserte begrensninger, inkludert utfordringer med konsistens, bevegelse og tekstgjengivelse.
Google DeepMindGemini Omni oversikt
Google DeepMinds oversikt beskriver Gemini Omni som en modell for å lage og redigere videoer med samtaleretning.
Google DeepMindVanlige spørsmål om Gemini Omni Flash
Er Gemini Omni Flash en tekst-til-video-modell?
Google dokumenterer en tekst-til-video-arbeidsflyt for Gemini Omni Flash. Den gjeldende modellsiden lister opp tekst-, bilde- og videoinndata med videoutdata i API-en.
Hva er den stabile Gemini Omni Flash API-modellen?
Googles gjeldende modell-dokumentasjon lister opp gemini-omni-1.1-flash som den stabile API-modellen og gemini-omni-flash-preview som en forhåndsvisningsmodell.
Kan Gemini Omni Flash redigere video?
Google dokumenterer redigering og utvidelse av støttede opplastede klipp, samt tilstandsbasert samtale-forbedring. Tilgjengelighet og arbeidsflytbegrensninger gjelder.
Bruker Story321 Gemini Omni Flash?
Denne siden er en informativ modellveiledning. Den hevder ikke at Gemini Omni Flash driver Story321s videoverktøy.
Utforsk videoworkflows på Story321
Tekst til video
Lag korte videoer fra en skrevet ledetekst.
Åpne Tekst til videoBilde til video
Start en videoworkflow fra et bilde.
Åpne Bilde til videoAI-videoredigering
Utforsk Story321s videoredigeringsområde.
Åpne AI-videoredigeringUtvid video
Fortsett en video med Story321s utvidelsesworkflow.
Åpne Utvid videoVelg riktig videoworkflow
Bruk Story321s videoverktøy for prosjektet ditt, eller se Googles offisielle dokumentasjon når du vurderer Gemini Omni Flash selv.
Modell-detaljene er basert på de lenkede offisielle kildene og kan endres ettersom Google oppdaterer API-en.