如何使用 Gemini Omni

Step 1

新增參考素材

上傳用於引導人物、視覺風格、動作和節奏的圖片、影片片段、Logo 或音訊。

Step 2

描述場景或編輯要求

使用日常語言說明想要的場景。編輯現有影片時,每次描述一個明確改動,幫助 Gemini Omni 保留無關細節。

Step 3

生成並繼續細化

生成影片並檢查動作、光線、文字和音訊,然後繼續透過對話完善具體部分,滿意後下載。

為什麼選擇 Gemini Omni

原生多模態創作

在一個創作請求中組合文字、圖片、音訊和影片參考。Gemini Omni 會共同理解這些素材,建構統一場景,而不是把每種輸入視為彼此獨立的步驟。

對話式多輪編輯

使用自然語言指令更換背景、鏡頭角度、物件或視覺風格。多輪編輯可逐項完善細節,同時維持整個片段的連貫性。

協調動作、音訊與文字

讓動作、聲音與畫面文字協調呈現,適合製作更清晰的解說影片、品牌片段、社群影片和視覺故事,無需分別處理每一種元素。

Gemini Omni 1.1 Flash 與原版 Omni Flash 比較

目前頁面

Original Omni Flash

場景延續上下文
僅參考最後 1 秒
累計延長長度
初始工作流程較短
首尾幀控制
推出時未重點支援
草稿解析度
標準生成流程
最終解析度
較早期的輸出選項
影片參考
參考工作流程較受限
適用情境
標準 AI 影片生成
使用 Gemini Omni 創作
新版本

Gemini Omni 1.1 Flash

場景延續上下文
最長 10 秒
累計延長長度
累計最長 40 秒
首尾幀控制
支援
草稿解析度
360p 快速預覽
最終解析度
1080p 或 4K 放大
影片參考
最長 3 秒
適用情境
可控製作與快速迭代
查看 1.1 Flash

誰在使用 Banoo AI?

日常創作者

將簡單創意快速變成插畫、社群圖片和熱門風格作品。還可以透過自然語言編輯個人照片,無需複雜的修圖軟體。

行銷與商務團隊

製作風格一致的商品圖、AI 虛擬人物、廣告素材和資訊圖。透過多種 AI 模型比較效果、最佳化版面,並保持行銷視覺的一致性。

數位藝術家

透過多輪創作完善角色、場景和視覺概念。保持人物面容、服裝與藝術方向一致,適用於漫畫、故事板、短片及其他創意專案。

Gemini Omni 常見問題

什麼是 Gemini Omni?
Gemini Omni 是 Google 面向混合輸入內容生成推出的多模態模型系列。首個以影片為核心的 Gemini Omni Flash 可融合文字、圖片、音訊和影片參考,並支援對話式影片編輯。
可以使用哪些參考素材?
可以使用文字指令、靜態圖片、品牌素材、音軌和現有影片片段來引導專案。只需加入能夠說明所需人物、環境、風格、動作或節奏的參考內容。
Gemini Omni 可以透過對話編輯現有影片嗎?
可以。使用自然語言描述明確改動,例如替換背景或調整物件。分多輪進行聚焦修改,並說明哪些元素需要保持不變。
Gemini Omni 提示詞應該怎麼寫?
描述所需主體、動作、環境、鏡頭運動、視覺風格、光線和聲音。修改時,每輪調整一個主要變數,並明確指出要編輯的場景部分。
Gemini Omni 適合哪些專案?
Gemini Omni 適合社群短片、產品視覺、解說影片、品牌內容、故事概念和電影感實驗,尤其適用於需要混合參考與迭代編輯的專案。

使用 Gemini Omni 開始創作

在 Banoo AI 中彙集參考素材與創意,生成連貫影片,並透過對話繼續完善細節。