Gemini Omni 1.1 Flashとは?シーン延長・4Kアップスケールなど新機能と料金を解説

Posted at 2026 年 08 月 29 日

Gemini Omni 1.1 Flashは、Googleが2026年8月27日に発表した動画生成・編集向けのAIモデルです。同年6月に提供が始まったGemini Omni Flashの後継にあたり、開発者向けに正式版として公開されました。

今回のアップデートでは、既存の動画から続きを生成するシーン延長、開始と終了のコマを指定するfirst / lastフレーム制御、低コストで試せる360pドラフトモード、そして4Kアップスケールが追加されました。動画を1回で作り切るのではなく、細かく制御しながら仕上げていくための機能が中心です。

この記事では、Gemini Omni 1.1 Flashの新機能、無印のGemini Omni Flashとの違い、料金体系、そして提供チャネルを順に整理します。

Gemini Omni 1.1 Flashとは

Gemini Omni 1.1 Flashは、Google DeepMindが開発した動画生成・編集に特化したマルチモーダルモデルです。モデルIDは gemini-omni-1.1-flash。

前身にあたるGemini Omni Flashは、2026年5月のGoogle I/Oで発表され、6月30日にGemini API/Google AI Studioでパブリックプレビューが始まりました。テキスト・画像・動画・音声を入力に取り、対話しながら動画を修正していく「会話型編集」が最大の特徴です。1回で完成品を狙うのではなく、「もう少し寄って」「音楽をドラマチックに」と言いながら仕上げていく設計になっています。

1.1はその路線を引き継いだうえで、公式ブログの言葉を借りれば「production-ready(実運用に耐える)」にするためのアップデートです。プレビュー版で足りなかった制御性・コスト効率・出力解像度が、まとめて埋められました。

新機能1:シーン延長(最大40秒)

シーン延長(Scene Extension)は、既存の動画の続きを、途切れなく生成し続ける機能です。

ポイントは参照できる文脈の長さです。従来モデルは動画の最後の1秒しか見ていませんでした。1.1では直前の最大10秒を解析します。カメラの動き、登場人物の位置、照明の調子といった情報が引き継がれるため、繋ぎ目の破綻が起きにくくなっています。

延長は10秒刻みで、累計40秒まで。Gemini APIでは、前回の生成結果のIDを previous_interaction_id として渡し、「Continue the scene.」のような指示を添えて呼び出します。会話の続きとして動画を伸ばしていく、という設計がAPIの形にも現れています。具体的な記法はGemini API 公式ドキュメント(Omni)で確認できます。

新機能2:first / lastフレーム指定

始点と終点のコマを画像で渡し、その間を生成させる機能です。

一発勝負のプロンプトでは、カメラワークは運任せになります。ここが指定できると、話が変わります。

  • 複雑なカメラのオービット(対象の周りを回り込む動き)
  • ズームによるシーン転換
  • 始点と終点を同じ画像にしたシームレスなループ

いずれも「間をどう繋ぐか」だけをモデルに任せられるため、演出の再現性が上がります。公式デモでも、ドラマーからサックス奏者へのホイップパンや、TV画面の中に吸い込まれていくズームといった、カット割りのないワンショットが例に挙げられています。

新機能3:360pドラフトモード

360pの軽量プレビューを生成するモードです。標準の720pと比べて最大60%高速コストは約1/3

動画生成は「当たり」を引くまで何本も回すのが実情です。そのすべてを720pで焼くのは、時間の面でもコストの面でも無駄が多い。構図とタイミングの確認は360pで済ませ、決まったカットだけ本番解像度で焼き直す、という運用が現実的になります。

絵コンテの反復、A/B比較、開発中のプレビュー表示などが主な想定用途です。

新機能4:4Kアップスケール

出力を1080pまたは4Kに引き上げられるようになりました。

ただしここは注意が必要です。4Kはネイティブ生成ではなく、アップスケーリング処理である点が複数のメディアで指摘されています。720pで生成した映像を引き伸ばしている以上、4Kネイティブ撮影の素材と同じディテールが出るわけではありません。

とはいえ、納品物の解像度要件を満たす手段が公式に用意された意味は小さくありません。従来は外部のアップスケーラーを別途通す必要がありました。

新機能5:動画リファレンス入力

マルチモーダル入力に、最大3秒の参照動画を含められるようになりました。

画像リファレンス(キャラクターの見た目を揃える)に加えて、動きそのものを参照できます。公式例では、3本のダンス動画と3枚のキャラクター画像を渡し、「犬にはクラシック、タコにはヒップホップ、クマにはブレイクダンスを踊らせて、全員を同じ空間でワンショットに」という指示が通っています。

モーションキャプチャの代替、とまでは言えませんが、動きのトーンを揃える用途では実用的です。

料金

解像度ごとの秒単価は次のとおりです。

  • 360p:1秒あたり 0.03ドル
  • 720p(既定):1秒あたり 0.10ドル
  • 1080p:1秒あたり 0.15ドル
  • 4K:1秒あたり 0.30ドル

10秒のクリップなら、360pで約0.3ドル、720pで約1ドル、4Kで約3ドルという計算になります。720pの単価は無印Omni Flashから据え置きで、下(360p)と上(1080p / 4K)に選択肢が広がった形です。

40秒フルに延長して4Kで出すと12ドル。ドラフトで詰めてから本番を焼く運用が、そのままコスト最適化になります。

どこで使えるか

開発者向けの提供チャネルは次の2つです。

一般ユーザー向けには次の形で提供されています。

  • Google Flow:Google AI Plus / Pro / Ultra 加入者にグローバル提供
  • Geminiアプリ:シーン延長のみ、同じく Plus / Pro / Ultra 加入者向け

すでにAdobe Firefly、Figma Weave、Runway、GMI Cloud といった製品への組み込みも進んでいます。

Google AI Studioで実際に試してみた

事前にAI Studioで請求先アカウントを作成およびクレジットを購入する必要があります。

1. モデルを開く

AI StudioでGemini Omni 1.1 Flashを開く。URLでモデルが指定されるので、選択の手間はありません。

必要に応じて右側の設定パネルで 解像度や、アスペクト比はauto(既定)を変更してください。

2.プロンプトを入力

生成したい内容を入力します。
※日本語で内容を入力すると失敗するので英語を推奨

動画生成され再生やダウンロードが可能になります。

使うときの注意点

  • 4Kは「アップスケール」:ネイティブ4Kではないため、拡大に耐えるディテールが必要な案件では事前に検証してください
  • 延長は40秒が上限:長尺は複数カットを繋ぐ前提で設計する必要があります
  • プレビュー版の廃止期限:gemini-omni-flash-preview は2026年9月30日で終了。移行済みか確認を
  • コストは秒課金:尺 × 解像度で素直に増えます。試行錯誤のフェーズは必ず360pで
  • 文脈参照は最大10秒:それ以前の内容は引き継がれません。長い延長では設定がドリフトしうる前提で

まとめ

  • Gemini Omni 1.1 Flashは、Googleの動画生成・編集特化モデル gemini-omni-1.1-flash(2026年8月27日発表)
  • 新機能はシーン延長(最大40秒・10秒文脈参照)first / lastフレーム指定360pドラフト4Kアップスケール動画リファレンス入力の5つ
  • 料金は秒課金で、360p 0.03ドル / 720p 0.10ドル / 1080p 0.15ドル / 4K 0.30ドル
  • 「Omni 1.1」という単体モデルはなく、Omniラインは現時点でFlashのみ
  • 旧 gemini-omni-flash-preview は2026年9月30日に廃止

方向性としては、動画生成AIが「ガチャを回して当たりを待つ道具」から「尺とカメラを指定して詰めていく道具」へ移りつつある、というアップデートです。まずはGoogle AI Studioで、8秒のクリップを1回だけ延長してみるのが分かりやすい入口だと思います。繋ぎ目がどれくらい自然かは、実際に見ないと感覚が掴めません。

■参考リンク

DevpediaCode編集部

DevpediaCodeはWeb、AIなどプログラムに関する最新ITテーマの情報を発信するメディアです。

お問合せ下記のURLからお願いします。

https://devpediacode.com/contact