Gemini Omni

2.70
テキスト、画像、音声、動画をまとめて理解し、自然な言葉で指示しながら動画を生成・修正できるマルチモーダルAIモデル。
Advertisement 728 × 90
会社Google
カテゴリーAI動画
リリース2026-05
更新日2026-08-19

Gemini Omni 概要

Gemini Omniは、一般的な**「画像から動画をつくる」ツールとは少し違います。**

1枚の画像を動かすだけではなく、テキスト、画像、音声、動画クリップを同時に入力し、それらをもとにひとつの動画を生成できます。

さらに、生成後に最初からやり直す必要もありません。
編集者に追加の指示を出すような感覚で、そのまま修正を続けられます。

たとえば、バイオリンを演奏している動画をアップロードして、

「背景をニューヨークのタイムズスクエアに変えて」
「バイオリンを消して」
「ミディアムショットにして」

と指示すると、前のバージョンをベースに、人物、背景、ライティング、音声などを調整していきます。

最初に登場したモデルはGemini Omni Flashで、主にGeminiとFlowを通じて提供されています。今後はYouTube ShortsやYouTube Createなど、Googleの他の製品にも段階的に広がっていく予定です。

Gemini Omni 料金プラン

プラン価格説明
Free $0 入門向けのプラン。 Gemini Omniを利用できますが、使用上限は低めで、まず軽く試してみたい人に向いています。
Basic $19.99/月 より高い利用上限があり、日常的な制作や比較的頻繁な動画生成に向いています。
AI Ultra $99.99/月 高頻度で使うクリエイターや技術ユーザー向け。 利用上限はProのおよそ5倍で、より大容量のクラウドストレージも含まれます。
AI Ultra 上位プラン $199.99/月 より高い利用上限と、すべての高度な機能を利用可能。 AIを本格的に使うプロフェッショナルやヘビーユーザー向けです。

Gemini Omniは単体で課金されるのではなく、Google AIのサブスクリプションに含まれています。

まず試してみたいなら、AI Plusがいちばん入りやすいプランです。
動画生成を日常的に使うなら、Proのほうが実用的です。
Ultraは、より高頻度な制作やプロ向けのワークフローを想定したプランです。

Gemini Omni 主な機能

  1. マルチモーダル動画生成
    テキスト、画像、音声、動画クリップを同時に入力し、それらを組み合わせてひとつの統一感ある動画を生成できます。
  2. 対話形式の動画編集
    生成後も自然な言葉で背景、動き、カメラワーク、雰囲気などを修正できます。毎回ゼロから生成し直す必要はありません。
  3. キャラクターとシーンの一貫性
    複数のショットや編集を重ねても、人物の顔、服装、髪型、周囲の環境をできるだけ維持します。
  4. 物理世界の理解
    重力、慣性、液体、物体の動きなどをある程度理解し、シンプルな動きのあるシーンでは自然さが大きく改善しています。
  5. 同期した音声生成
    動画の動きや環境に合った音声も同時に生成でき、あとから別途音を重ねる必要を減らせます。
  6. Avatar(アバター)
    ユーザーの見た目や声をもとにデジタルキャラクターを作り、新しいコンテンツ生成に利用できます。
  7. SynthIDデジタルウォーターマーク
    生成コンテンツには目に見えないデジタルウォーターマークが埋め込まれ、AI生成コンテンツの識別や追跡に使われます。

Gemini Omni 編集部レビュー

私が特に注目したのは、複数回にわたる編集キャラクターの一貫性です。

使い始めやすさ:かなり低いです。

GeminiやFlowでプロンプトを入力すれば、そのまま動画を生成できます。結果を大きく左右するのは細かいパラメータよりも、カメラ、動き、雰囲気をどれだけ具体的に伝えられるかです。

たとえば、

「人が街を歩いている」

だけでも生成できますが、

「ミディアムショットからゆっくり寄る。人物は赤いコートを着ていて、雨上がりの道路にネオンが反射している」

のように書いたほうが、結果は安定しやすくなります。

いちばん大きな変化は、毎回“引き直す”必要が減ったことです。

これまでのAI動画では、一部分だけ気に入らなくても、映像全体を生成し直すことがよくありました。

Gemini Omniはそれよりも、今ある結果をベースに、そのまま修正を続ける感覚に近いです。

キャラクター自体は問題なくて、背景だけ変えたい。
カメラだけ調整したい。
光の雰囲気だけ変えたい。

そういう場合も、そのまま追加で指示できます。

キャラクターの一貫性も以前より安定しています。複数のショットでも、顔、服装、人物の位置などが突然変わりにくくなっていて、短編映像や広告ではかなり重要な改善です。

ただし、複雑なシーンではまだ失敗します。

単純な重力、布の動き、物体の移動などは比較的自然ですが、複数の物体が同時にぶつかったり、複雑な因果関係が入ったりすると、映像が崩れることがあります。

文字生成も依然として弱点です。

参照画像に複雑な文字が入っていると、生成後にぼやけたり、変形したり、内容そのものが間違ったりすることがあります。

また、1回の生成は最長で約10秒なので、まとまった短編を作るには複数のクリップをつなぐ必要があります。

良いところ

  • 対話形式の編集が実用的。
    同じ動画をそのまま修正し続けられるので、毎回作り直す回数を減らせます。
  • 入力方法が柔軟。
    テキスト、画像、音声、動画を組み合わせて使えます。
  • キャラクターとシーンが安定しやすい。
    複数ショットでも、以前より連続性を保ちやすくなっています。
  • 映像と音声を同時に生成できる。
    後から音声や環境音を付ける作業を減らせます。
  • Google製品との連携が自然。
    Gemini、Flow、YouTubeとの流れが作りやすいです。

気になるところ

  • 1回の生成時間はまだ短い。
    約10秒の上限は、長いコンテンツでは明確な制約になります。
  • 複雑な物理シーンはまだ崩れる。
    複数物体の相互作用、衝突、因果関係などは不安定です。
  • 文字生成は信頼しにくい。
    特に複雑な英語や中国語ではミスが起こりやすいです。
  • 細部のコントロールには限界がある。
    対話編集は全体方向の調整には便利ですが、プロ向け編集ソフトのようなフレーム単位の制御はできません。
  • 本格的に使うなら有料プランが必要。
    主要機能をしっかり試すには、基本的に有料プランが前提になります。

向いている人

コンテンツクリエイター・動画制作者

B-roll、クリエイティブ素材、短い動画クリップをすばやく作る用途に向いています。

広告・マーケティングチーム

コンセプトムービー、提案用素材、ビジュアル方向のテストに使いやすいです。

教育・解説コンテンツの制作者

抽象的な概念を短時間で動きのある映像に変えたい場合に便利です。

映像・アニメーションのプリプロダクションチーム

絵コンテ、カメラワーク、シーンの雰囲気を事前に試す用途に向いています。

あまり向いていない人

映画レベルの完成映像が必要な人

現時点では、実写撮影、CG、プロフェッショナルなポストプロダクションを完全に置き換えるものではありません。

フレーム単位のコントロールが必要な人

対話形式の編集は、細かな編集よりも大きな方向修正に向いています。

画面内の文字を重視する人

文字のレンダリングはまだ十分に安定していません。

長時間の連続動画が必要な人

現状では、複数の短いクリップを生成してつなぐ必要があります。

まとめ

Gemini Omniで本当に注目したいのは、画質がどれだけ上がったかではなく、AI動画の作り方そのものが変わり始めたことです。

これまでは、どちらかというと“ガチャ”に近い体験でした。
プロンプトを入れて、結果を待って、気に入らなければもう一度生成する。

今はそこから、まず作って、そこから会話しながら少しずつ直していく形に変わりつつあります。

これは、AI動画が初めて普通の制作フローに近づいてきた変化だと思います。

もちろん、まだ完成されたツールではありません。約10秒という生成時間、複雑な物理表現、文字生成など、弱点ははっきり残っています。

それでも方向性はかなり明確です。

これから動画を作ることは、だんだん「編集者と会話しながら仕上げる」感覚に近づいていくのかもしれません。

コメント(0件)

コメントを書く

Advertisement 728 × 90

類似ツール

Neural Frames
82
音楽に合わせて映像そのものが動き出すAI動画ツール。 単に動画を生成するのではなく、ビートや音の流れに合わせて映像をシンクロさせることに重点を置いています。
AI動画
Face Swap by Akool
80
リアルさと複数人の顔交換に強いAIフェイススワップツール。 写真をアップロードするだけで顔を入れ替えられますが、動画の仕上がりと商用利用のライセンス条件には注意が必要です。
AI動画
Runway Gen-4.5
72
リアルな動き、カメラコントロール、キャラクターの一貫性を重視したAI動画モデル。 単に「見栄えのいい短い動画を生成する」だけでなく、より本格的な映像制作ツールへと進化し始めています。
AI動画AI漫画ドラマ
Descript
68
文書を編集する感覚で動画を編集。動画編集が、もう専門スキルだけのものではなくなる。
AI動画
Kaiber
67
複数のAI動画モデルをひとつのキャンバスにまとめ、単発の生成ではなく、映像制作の流れ全体を組み立てられるプラットフォーム。
AI動画
Cutout Pro
59
AIを活用した画像・動画制作プラットフォームです。AIによる背景削除、画像補正、動画生成、写真修復、クリエイティブ編集など、幅広いビジュアル制作機能を提供しています。
AI動画AI画像
Synthesia
57
AIアバターで140以上の言語に対応。テキストを簡単にプロ動画に変換するプラットフォーム。
AI動画
Luma Dream Machine
54
Luma Dream Machineは、Luma AIが開発したAI動画生成プラットフォームです。
AI動画AI漫画ドラマ

関連モデル

関連ニュース