Gemini Omniの使い方

Step 1

参照素材を追加

人物、ビジュアルスタイル、動き、リズムの手掛かりとなる画像、動画クリップ、ロゴ、音声をアップロードします。

Step 2

シーンや編集内容を説明

日常的な言葉で希望するシーンを説明します。既存動画を編集する場合は、Gemini Omniが他の部分を維持できるよう、一度に一つの変更を具体的に伝えます。

Step 3

生成して調整

動画を生成し、動き、照明、テキスト、音声を確認します。必要な部分を会話でさらに調整してからダウンロードします。

Gemini Omniを選ぶ理由

ネイティブなマルチモーダル制作

一つの制作指示にテキスト、画像、音声、動画の参照を組み合わせられます。Gemini Omniは各入力を別工程として扱わず、まとめて解釈して統一されたシーンを構築します。

会話による複数回の編集

背景、カメラアングル、オブジェクト、ビジュアルスタイルを自然な言葉で変更できます。複数回の編集でシーケンスの連続性を保ちながら、一つずつ細部を仕上げられます。

動き・音声・テキストの連携

動き、音声、画面内テキストが連動するシーンを作れます。各要素を別々の工程で組み立てずに、説明動画、ブランド動画、SNS動画、ビジュアルストーリーを制作できます。

Gemini Omni 1.1 Flashと初代Omni Flashを比較

表示中

Original Omni Flash

シーン延長の参照範囲
最後の1秒のみ
累計延長時間
短い初期ワークフロー
開始・終了フレーム制御
リリース時は非対応
ドラフト解像度
標準的な生成フロー
最終解像度
従来の出力オプション
動画参照
制限の多い参照フロー
最適な用途
標準的なAI動画生成
Gemini Omniで作成
新バージョン

Gemini Omni 1.1 Flash

シーン延長の参照範囲
最大10秒
累計延長時間
累計最大40秒
開始・終了フレーム制御
対応
ドラフト解像度
360pプレビュー
最終解像度
1080pまたは4Kアップスケール
動画参照
最大3秒
最適な用途
制御された制作と高速な反復
1.1 Flashを見る

Banoo AI は誰に使われていますか?

日常のクリエイター

シンプルなアイデアを、イラスト、SNS画像、トレンドを取り入れた作品へすばやく変換できます。複雑な編集ソフトを使わず、自然な言葉で個人写真も編集できます。

マーケティング・ビジネスチーム

統一感のある商品画像、AIキャラクター、広告素材、分かりやすいインフォグラフィックを作成できます。複数のAIモデルで結果を比較し、レイアウトを整えながらマーケティングビジュアルの一貫性を保てます。

デジタルアーティスト

制作を重ねながら、キャラクター、シーン、ビジュアルコンセプトを仕上げられます。顔、衣装、アートディレクションの一貫性を保ち、漫画、絵コンテ、短編映像などに活用できます。

Gemini Omniに関するよくある質問

Gemini Omniとは何ですか?
Gemini Omniは、複数形式の入力からコンテンツを生成するGoogleのマルチモーダルモデルファミリーです。動画向けの最初のモデルであるGemini Omni Flashは、テキスト、画像、音声、動画の参照を組み合わせ、会話形式の動画編集に対応します。
どのような参照素材を使えますか?
テキスト指示、静止画、ブランド素材、音声トラック、既存の動画クリップを利用できます。希望する人物、設定、スタイル、動き、タイミングを伝えるために必要な素材だけを追加してください。
Gemini Omniは会話で既存動画を編集できますか?
はい。背景の置き換えやオブジェクトの調整など、変更内容を自然な言葉で具体的に伝えます。複数回に分けて一つずつ編集し、維持したい要素も明示してください。
Gemini Omni向けのプロンプトはどう書けばよいですか?
被写体、動作、環境、カメラワーク、ビジュアルスタイル、照明、音声を説明します。修正するときは一度に一つの主要要素を変え、編集したいシーンの箇所を明確に指定してください。
Gemini Omniはどのような用途に向いていますか?
Gemini Omniは、SNS動画、商品ビジュアル、解説動画、ブランドコンテンツ、ストーリー案、映画的な表現実験など、複数の参照素材と反復編集を活かす制作に向いています。

Gemini Omniで制作を始める

Banoo AIで参照素材とアイデアを組み合わせ、一貫した動画を生成し、会話を通じて細部を仕上げましょう。