GoogleはI/O 2026でGemini Omniを発表しました。そして Gemini Omni Flash はファミリー初のモデルです。ほぼどんな入力からでも動画を作成でき、チャットするだけで編集を続けられるように設計されています。
画像でNano Bananaを使ったことがあるなら、これはその動画版です。高速でマルチモーダル、Geminiの現実世界への理解に基づき、しかもクレジット消費も手頃。Google自身も「動画版のNano Banana」と表現しています。
以下では、Gemini Omni Flashとは何か、何が作れるか、Googleのラインナップの中でどう位置づけられるか、そしてどこで試せるかをわかりやすく説明します。
要点
- Gemini Omni FlashはGoogle初のOmniファミリーモデルで、あらゆる入力から動画を生成します。
- テキスト・画像・動画を入力すると、ネイティブ音声付きの約10秒のクリップを出力します。
- 最大の特長は会話型編集。変更したい内容を説明するだけで動画を調整できます。
- Geminiの世界知識に基づいているため、物理表現もpromptへの忠実性もしっかり保たれます。
- OpenArtではVeo 3.1、Seedance 2.0、Kling Omniと並べて利用できます。
Gemini Omni Flashとは?
Gemini Omni Flash(技術名:gemini-omni-flash-preview)は、新しいGemini Omniファミリー初のリリースとなるGoogleの高速マルチモーダルAI動画モデルです。テキスト・画像・短い動画クリップを、同期した音声付きの完成映像へと変換します。
際立っているのはネイティブなマルチモーダル性です。テキスト・画像・音声・動画をまとめて処理するため、出力にまとまりがあり、コントロールしやすくなります。ゼロから再生成するのではなく、自然な会話を通じてクリップを一歩ずつ形にしていけます。
実際にできること
Gemini Omni Flashは、AI動画生成の3つの核となる作業をカバーします: テキストから動画、画像から動画、そして対話型編集(すべてネイティブオーディオ対応)。この対応範囲なら、最初のアイデアから最終調整まで、ショート動画のワークフローの大部分を1つのモデルでこなせます。
実際のクリエイターに役立つのはこんな場面です:
promptから生成:
シーンを説明すれば、音声付きの約10秒のクリップが手に入ります。
写真をアニメーション化:
静止画や商品写真にリアルな動きを加えて命を吹き込みます。
チャットで編集:
キャラクターを差し替えたり、照明を変えたり、クリップのスタイルを変更したり——説明するだけで、それ以外の部分はそのまま保たれます。
リファレンスで一貫性を保つ:
キャラクター、スタイル、構図に画像を指定できます。
読みやすい画面内テキストを実現:
promptに文字を入れるだけで、Omniがきれいにレンダリングします。
物理・歴史・文化についてのGeminiの知識に基づいているため、短くシンプルなpromptでも狙い通りの結果になりやすいです。
GoogleのAIモデルラインナップにおけるGemini Omni Flashの位置づけ
Omni Flashは、Omniファミリーの中でスピードとコスト効率を重視したモデルで、大量かつ反復的な作業向けに設計されています。Geminiアプリでは動画モデルとしてVeoに代わって採用されており、Google Flowの動画生成も担っています。
「Flash」という名前は、Geminiシリーズ全体と同じ意味を持ちます。つまり高速で手頃、最長・最高解像度のレンダリングよりもスピーディーな仕上がりに最適化されているということです。ほとんどのショート動画には、まさにこのバランスがぴったりです。
Gemini Omni Flashを最も手軽に試す方法:OpenArt
別途Google AIのプランや技術的なセットアップは一切不要です。Omni Flashを最も手軽に試せるのはOpenArtで、ブラウザですぐに使えます。
さらに大きなメリットは、OpenArtの AI動画生成 は1つのモデルに限りません。Gemini Omni Flashに加えて、Veo 3.1、Seedance 2.0、Kling Omniなどを1つのプランで切り替えて使え、Upscale VideoやExtend Videoといったツールでショットを仕上げられます。
スピードとチャットベースの編集が欲しいときはOmni Flashで生成し、プロジェクトに別の要素が必要なときは他のモデルに切り替えましょう。
よくある質問:Gemini Omni Flashガイド
Gemini Omni Flashは何をベースにしていますか?
GoogleのGemini Omniファミリー初のモデル(gemini-omni-flash-preview)で、ネイティブにマルチモーダルな動画生成・編集モデルです。
動画の長さはどれくらいですか?
1回の生成でおよそ10秒、ネイティブ音声付きです。OpenArtではExtend Videoで長さを追加できます。
Gemini 2.0 Flashと同じものですか?
いいえ。あれは言語モデルでした。Omni FlashはGemini Omniファミリーの2026年発表の専用動画モデルです。
再生成せずにクリップを編集できますか?
はい。チャットで変更内容を説明するだけで、Omni Flashがシーン・動き・フレーミングのそれ以外の部分をそのまま保ったまま反映します。
どこで使えるの?
GoogleのGeminiアプリやFlow、Gemini API、またはOpenArt上でトップクラスの他の動画モデルと並んでご利用いただけます。