Google Flow 是一個以 Veo 模型為核心的 AI 影片創作平台;而 Gemini Omni(如 Gemini Omni Flash)則是 Google 推出的 多模態對話與生成底層模型。兩者並非競爭關係,而是平台與模型的分工協作關係,且 Google Flow 現已整合 Gemini Omni 來強化對話編輯能力。
功能與定位差異
Google Flow (創作平台)
- 核心定位:專為創作者打造的 AI 影片生成與剪輯工作台。
- 技術應用:結合多種 Veo 影片模型與 Gemini 技術。
- 主要功能:支援大型場景建立、角色一致性維持與多鏡頭運鏡控制。
Gemini Omni (底層 AI 模型)
- 核心定位:具備強大多模態與即時處理能力的智慧創作模型。
- 技術應用:作為 Gemini 應用程式與 Google Flow 的大腦。
- 主要功能:支援自然語言的對話式影片編輯、跨媒介內容理解與指令流水線優化。
協作與應用方式
- 分工合作:Gemini Omni 負責處理人類的語意對話、精細指令與多模態輸入,而 Veo/Flow 則負責高效率的影片畫質渲染與生成。
- 實際體驗:用戶可以在 Google Flow 介面中直接呼叫 Gemini Omni 的對話能力來修改影片細節。