Gemini Omniは、Google DeepMindがGeminiプロジェクトの一環として開発したAI動画モデルファミリーです。テキストプロンプトや画像を渡すと、完成された動画が返ってきます。設計されたショット、動くカメラ、そしてリップシンクしたセリフ付きのネイティブ音声 — すべてが一度の生成パスで作られます。
Googleは2026年5月のI/O基調講演でOmniを発表し、最初の公開モデルGemini Omni Flashを6月30日にプレビューとしてリリースしました。対話形式の編集に対応した720pのテキストから動画モデルで、独立評価のLMArena Video Arenaではテキストから動画部門1位(ブラインド人間投票で1515 Elo)としてデビュー。後継のGemini Omni 1.1 Flashは2026年8月27日に一般提供となりました。
Gemini Omniの何が違うのか
- ネイティブ音声、後付けではなく。音楽、効果音、声が映像と同時に生成され、アクションと同期します。セリフを引用符で囲めば、キャラクターが口の動きまで合わせて話します。
- 対話形式の編集。完成したクリップは会話の終わりではありません。「ゴールデンアワーにして」「ジャケットをトレンチコートに」と言えば、モデルはその変更だけを反映してシーンを再生成します。
- リファレンスと延長。Omni 1.1 Flashは1回の生成で画像リファレンスと最大3本の短い動画クリップを受け付け、最初と最後のフレーム間を補間し、完成したシーンを10秒ずつ最大40秒まで延長できます。
どこで使えるのか
OmniRenderはOmniモデルをブラウザで動かします。順番待ちもインストールも不要。無料プランにはカード不要で毎月数本の360p動画が含まれ、月額14ドルからの有料プランでは動画本数の増加、720p〜4K出力、動画リファレンス、商用ライセンスが加わります。開発者はOmni APIから同じモデルを呼び出せます。
透かしと由来情報
Gemini Omniで生成されたすべてのクリップには、Googleの不可視透かしSynthIDとC2PA由来メタデータが付与されます。動画に見える刻印を入れることなく、AI生成映像の識別可能性が保たれます。
最初のクリップを作る準備はできましたか?Gemini Omni Flashの使い方はこちら