Gemini Omni Flash: Model Video AI Percakapan Google
Gemini Omni Flash adalah keluarga model Google untuk pembuatan dan pengeditan video percakapan yang cepat, dengan video sebagai output API yang didokumentasikan.
Apa itu Gemini Omni Flash?
Gemini Omni Flash adalah keluarga model AI Google yang dibangun untuk pembuatan dan pengeditan video percakapan yang cepat. Dokumentasi API Gemini Google mengidentifikasi Gemini Omni 1.1 Flash sebagai model API stabil saat ini dan mencantumkan video sebagai modalitas output API. API Gemini Omni Flash dapat bekerja dari teks, gambar, atau input video yang didukung. Google mendokumentasikan alur kerja untuk membuat video dari prompt, menganimasikan gambar, mengedit atau memperpanjang klip yang diunggah, dan menyempurnakan hasil melalui interaksi stateful. Ini adalah panduan model independen. Story321 tidak mengklaim bahwa Gemini Omni Flash mendukung alat videonya.
Kemampuan yang didokumentasikan
Teks-ke-video
Buat video dari prompt teks melalui alur kerja API Gemini yang didokumentasikan oleh Google.
Gambar-ke-video
Gunakan gambar sebagai titik awal untuk hasil video animasi.
Pengeditan percakapan
Gunakan API Interaksi dan ID interaksi sebelumnya untuk terus menyempurnakan hasil sebelumnya.
Pengeditan dan perpanjangan video
Google mendokumentasikan pengeditan video yang diunggah dan menambahkan perpanjangan ke klip yang memenuhi syarat.
Interpolasi bingkai
Hasilkan video transisi dari bingkai pertama dan terakhir yang disediakan.
Beberapa opsi output
Dokumentasi resmi mencantumkan opsi output 360p, 720p, 1080p, dan 4K, tergantung pada alur kerja yang dipilih dan ketersediaan.
Fakta API terkini
| Features | Gemini Omni Flash |
|---|---|
Model API stabil | gemini-omni-1.1-flash |
Model API pratinjau | gemini-omni-flash-preview |
Input yang didokumentasikan | Teks, gambar, dan video; video yang diunggah untuk diedit atau diperpanjang terbatas pada klip yang memenuhi syarat hingga 10 detik. |
Output yang didokumentasikan | Video |
Durasi video yang didokumentasikan | 3 hingga 10 detik |
Frame rate yang didokumentasikan | 24 FPS |
Jendela konteks yang didokumentasikan | 1.048.576 token |
Di mana bisa digunakan
Klip pendek berbasis prompt
Buat prototipe konsep video singkat dari adegan, aksi, atau arahan visual tertulis.
Animasi gambar diam
Ubah gambar yang diberikan menjadi rekaman bergerak pendek saat alur kerja gambar-ke-video sesuai.
Arahan video berulang
Lanjutkan percakapan tentang hasil yang dihasilkan alih-alih memulai setiap pengeditan dari awal.
Revisi klip pendek
Edit klip yang diunggah yang memenuhi syarat atau tambahkan kelanjutan saat alur kerja resmi mendukungnya.
Akses dan ketersediaan
Google mendokumentasikan Gemini Omni Flash di Gemini API dan menyediakan titik masuk AI Studio untuk Gemini Omni 1.1 Flash. Periksa dokumentasi terbaru Google sebelum membuat alur kerja karena pengenal model, ketersediaan regional, dan fitur yang didukung dapat berubah. Nama model dapat merujuk pada keluarga Gemini Omni yang lebih luas dalam materi Google, sementara Gemini Omni 1.1 Flash adalah model API stabil yang disebutkan dalam dokumentasi model saat ini.
Batasan penting
Documented limitation
Google mencantumkan pembatasan untuk beberapa alur kerja pengeditan dan perpanjangan berdasarkan wilayah, termasuk EEA, Swiss, dan Inggris.
Documented limitation
Pengeditan dan perpanjangan video yang diunggah terbatas pada klip yang didukung hingga 10 detik; perpanjangan ditambahkan di akhir video.
Documented limitation
Panduan API Google saat ini mencantumkan pengeditan suara, referensi audio, dan alur kerja multi-video sebagai tidak didukung atau tidak tersedia dalam alur kerja yang dijelaskan.
Documented limitation
Kartu model Gemini Omni Flash mencatat batasan seputar konsistensi pengeditan, gerakan kompleks, dan rendering teks yang akurat.
Sumber resmi
Dokumentasi model Gemini Omni Flash
Halaman model Google mencantumkan pengenal model API stabil dan pratinjau, modalitas yang didokumentasikan, durasi, resolusi, frame rate, dan jendela konteks.
Google AI untuk PengembangPanduan API Gemini Omni
Panduan alur kerja Google mencakup teks-ke-video, gambar-ke-video, pengeditan stateful, interpolasi bingkai, pengeditan video, perpanjangan, dan batasan saat ini.
Google AI untuk PengembangKartu model Gemini Omni Flash
Kartu model Google DeepMind menjelaskan penggunaan yang dimaksudkan dan batasan yang dipublikasikan, termasuk tantangan konsistensi, gerakan, dan rendering teks.
Google DeepMindIkhtisar Gemini Omni
Ikhtisar Google DeepMind menjelaskan Gemini Omni sebagai model untuk membuat dan mengedit video dengan arahan percakapan.
Google DeepMindFAQ Gemini Omni Flash
Apakah Gemini Omni Flash adalah model teks-ke-video?
Google mendokumentasikan alur kerja teks-ke-video untuk Gemini Omni Flash. Halaman modelnya saat ini mencantumkan input teks, gambar, dan video dengan output video di API.
Apa model API stabil Gemini Omni Flash?
Dokumentasi model Google saat ini mencantumkan gemini-omni-1.1-flash sebagai model API stabil dan gemini-omni-flash-preview sebagai model pratinjau.
Bisakah Gemini Omni Flash mengedit video?
Google mendokumentasikan pengeditan dan perpanjangan klip yang diunggah yang didukung, plus penyempurnaan percakapan stateful. Pembatasan ketersediaan dan alur kerja berlaku.
Apakah Story321 menggunakan Gemini Omni Flash?
Halaman ini adalah panduan model informasional. Tidak menyatakan bahwa Gemini Omni Flash mendukung alat video Story321.
Jelajahi alur kerja video di Story321
Teks ke Video
Buat video pendek dari prompt tertulis.
Buka Teks ke VideoGambar ke Video
Mulai alur kerja video dari gambar.
Buka Gambar ke VideoEditor Video AI
Jelajahi ruang kerja pengeditan video Story321.
Buka Editor Video AIPerpanjang Video
Lanjutkan video dengan alur kerja perpanjangan Story321.
Buka Perpanjang VideoPilih alur kerja video yang tepat
Gunakan alat video Story321 untuk proyek Anda, atau baca dokumentasi resmi Google saat mengevaluasi Gemini Omni Flash itu sendiri.
Detail model didasarkan pada sumber resmi yang ditautkan dan dapat berubah seiring pembaruan API oleh Google.