Gemini Omni Flash:Google 的對話式 AI 影片模型
Gemini Omni Flash 是 Google 的模型系列,專為快速對話式影片生成與編輯而設計,並以影片作為其文件化的 API 輸出。
什麼是 Gemini Omni Flash?
Gemini Omni Flash 是 Google 的 AI 模型系列,專為快速對話式影片生成與編輯而打造。Google 的 Gemini API 文件指出 Gemini Omni 1.1 Flash 是目前的穩定 API 模型,並將影片列為 API 輸出形式。 Gemini Omni Flash API 可接受文字、圖片或支援的影片輸入。Google 文件記錄了多種工作流程:從提示詞建立影片、將圖片動畫化、編輯或延長上傳的片段,以及透過狀態化互動來優化結果。 這是一份獨立的模型指南。Story321 並不聲稱其影片工具由 Gemini Omni Flash 驅動。
文件記錄的功能
文字轉影片
透過 Google 文件記錄的 Gemini API 工作流程,從文字提示詞建立影片。
圖片轉影片
以圖片作為動畫影片結果的起點。
對話式編輯
使用 Interactions API 和先前的互動 ID,繼續優化先前的結果。
影片編輯與延長
Google 文件記錄了上傳影片的編輯功能,以及為符合條件的片段附加延長內容。
幀插值
根據提供的第一幀和最後一幀生成過渡影片。
多種輸出選項
官方文件列出 360p、720p、1080p 和 4K 輸出選項,視所選工作流程與可用性而定。
目前 API 事實
| Features | Gemini Omni Flash |
|---|---|
穩定 API 模型 | gemini-omni-1.1-flash |
預覽 API 模型 | gemini-omni-flash-preview |
文件記錄的輸入 | 文字、圖片與影片;用於編輯或延長的上傳影片僅限於最多 10 秒的合格片段。 |
文件記錄的輸出 | 影片 |
文件記錄的影片長度 | 3 至 10 秒 |
文件記錄的幀率 | 24 FPS |
文件記錄的上下文視窗 | 1,048,576 個 token |
適用場景
提示詞驅動的短片段
根據書面場景、動作或視覺方向,快速製作簡短影片概念原型。
靜態圖片動畫
在適合圖片轉影片工作流程時,將提供的圖片轉為短暫的動態鏡頭。
迭代式影片指導
針對已生成的結果進行對話式的持續調整,而非每次編輯都從頭開始。
短片段修改
當官方工作流程支援時,編輯符合條件的上傳片段,或附加延續內容。
取得方式與可用性
Google 在 Gemini API 中記錄了 Gemini Omni Flash,並為 Gemini Omni 1.1 Flash 提供了 AI Studio 入口。在建立工作流程前,請查看 Google 的最新文件,因為模型識別碼、區域可用性與支援功能可能隨時變更。 在 Google 的資料中,模型名稱可能指更廣泛的 Gemini Omni 系列,而 Gemini Omni 1.1 Flash 是目前模型文件中所指的穩定 API 模型。
重要限制
Documented limitation
Google 列出了部分編輯與延長工作流程的區域限制,包括歐洲經濟區、瑞士和英國。
Documented limitation
上傳影片的編輯與延長僅限於最多 10 秒的支援片段;延長內容會附加在影片結尾。
Documented limitation
Google 目前的 API 指南指出,語音編輯、音訊參考以及多影片工作流程在所描述的工作流程中不受支援或無法使用。
Documented limitation
Gemini Omni Flash 模型卡註明了在編輯一致性、複雜動作與準確文字渲染方面的限制。
官方來源
Gemini Omni Flash 模型文件
Google 的模型頁面列出了穩定與預覽 API 模型識別碼、文件記錄的形式、長度、解析度、幀率與上下文視窗。
Google AI for DevelopersGemini Omni API 指南
Google 的工作流程指南涵蓋文字轉影片、圖片轉影片、狀態化編輯、幀插值、影片編輯、延長與目前限制。
Google AI for DevelopersGemini Omni Flash 模型卡
Google DeepMind 的模型卡說明預期用途與已發佈的限制,包括一致性、動作與文字渲染的挑戰。
Google DeepMindGemini Omni 概覽
Google DeepMind 的概覽將 Gemini Omni 描述為一個透過對話式指導來建立與編輯影片的模型。
Google DeepMindGemini Omni Flash 常見問題
Gemini Omni Flash 是文字轉影片模型嗎?
Google 為 Gemini Omni Flash 記錄了文字轉影片的工作流程。其目前的模型頁面列出文字、圖片與影片輸入,並在 API 中以影片作為輸出。
Gemini Omni Flash 的穩定 API 模型是什麼?
Google 目前的模型文件將 gemini-omni-1.1-flash 列為穩定 API 模型,gemini-omni-flash-preview 則為預覽模型。
Gemini Omni Flash 可以編輯影片嗎?
Google 記錄了編輯與延長支援的上傳片段,以及狀態化對話式優化功能。但適用性與工作流程限制仍然存在。
Story321 使用 Gemini Omni Flash 嗎?
此頁面為資訊型模型指南,並不表示 Gemini Omni Flash 驅動 Story321 的影片工具。
選擇合適的影片工作流程
使用 Story321 的影片工具進行您的專案,或在評估 Gemini Omni Flash 本身時參考 Google 的官方文件。
模型詳細資訊基於連結的官方來源,並可能因 Google 更新 API 而變更。