Omni 1.1 Flashとは、静止画とテキストの組み合わせから高品質なショート動画を即座に作り出す、Google Vids専用の動画生成AIです。デザインの専門知識や動画編集の現場経験がない方でも、ブラウザ上で直感的に動画制作を完結できます。社内プレゼン資料やSNS向けの告知映像を作る際、動画素材の調達に頭を抱えた経験はありませんか。
静止画に動きを吹き込む作業は、これまでプロ向けの高額な動画ソフトや複雑な生成AI環境を必要としていました。Omni 1.1 Flashの登場により、Googleドライブを開く感覚で短尺動画を量産できる環境が整いました。
Omni 1.1 Flashとは?Google Vidsに統合された動画生成モデルの全貌

Omni 1.1 Flashとは、Googleが開発した「Gemini Omni」シリーズの最新版であり、Google Vids内で画像と文章から滑らかな動画クリップを生成・編集できるAIモデルです。2026年9月23日にGoogle Workspaceおよび一般のGoogleアカウント向けへ無償提供が始まりました。
従来の動画生成AIは、テキストのみからゼロベースで映像を立ち上げる形式が主流でした。この方式は構図の破綻や被写体のブレが起きやすく、業務用途で狙い通りの絵柄を固定するのが困難でした。
Omni 1.1 Flashは「画像1枚」を参照画像として受け取ります。画像に含まれる被写体の形状、色彩、照明の質感を保持したまま、指定したカメラワークやアクションを映像化します。
先行して2026年8月27日に発表された初版のGemini Omniから、物理演算の自然さと指示に対する応答速度が強化されました。Googleのオフィススイート直結の環境で、ビジネス動画のワークフローを根本から組み替えるモデルです。
Google Vids上でOmni 1.1 Flashが使える基本スペックと仕様はどうなっているか?

Omni 1.1 Flashは、Webブラウザ上で動作するGoogle Vids(vids.new)の編集画面から直接呼び出せます。別アプリのインストールや特殊なプラグインの導入作業は不要です。
映像の解像度は720pおよび1080pに対応します。出力する縦横比(アスペクト比)は横長(16:9)だけでなく、スマートフォン向けの縦長(9:16)、正方形(1:1)などを制作目的に応じて自由に切り替え可能です。
次の表は、Omni 1.1 Flashの主要な動作仕様をまとめたものです。
| 項目 | Omni 1.1 Flashの仕様 | 備考 |
|---|---|---|
| 開発元 | Gemini Omniシリーズ最新版 | |
| 提供形態 | Google Vids内機能 | デスクトップ版Webブラウザ対応 |
| 利用料金 | 無料 | Googleアカウント所持者全員が対象 |
| 出力解像度 | 720p / 1080p | 用途に合わせて選択可能 |
| 対応縦横比 | 16:9 / 9:16 / 1:1 | 横長スライドから縦型ショートまで対応 |
| 入力データ | 静止画(JPEG/PNG等)+テキスト指示 | テキストのみの生成も可能 |
| 独自機能 | Extend(シーン拡張・継続) | 既存クリップの終端から後続シーンを生成 |
| 連携機能 | Gemini 3.8 Flash-Lite TTS(予定) | AIナレーション音声を近日追加予定 |
静止画の構図を保ちつつ解像度と縦横比を細かく制御できるため、業務プレゼンから縦型プロモーションまで即座に転用できます。
Omni 1.1 Flashの3大機能:静止画入力・指示文調整・Extend
Omni 1.1 Flashが支持される理由は、単なる動画出力の速さにとどまりません。現場のクリエイターが思い通りのシーンを形にするための3つの主要機能を備えています。
[商品写真やイラスト1枚] + [テキストの指示文]
↓
Omni 1.1 Flashが映像化
↓
[生成された動画クリップ]
↓
【Extend機能でさらに後ろへ拡張】
↓
[自然につながる連続シーンの完成]
1. 静止画1枚からの高精度なモーション生成
被写体のテクスチャや背景の光を認識し、指定された動きだけを付与します。例えば商品のボトル写真を入力し「背後からドラマチックな炎が立ち上る」と指示すると、ラベルの文字を崩さずに背景演出だけを動画化します。
2. 自然言語による対話的なカメラ・演出調整
プロンプト(AIへの指示文)を通じて、カメラの動きや天候、光の当たり方を細かく指定できます。「カメラをゆっくり右へパン」「夕暮れの光を差し込ませる」といった日常語の指示を忠実に解釈します。
3. 前後の連続性を保つExtend(シーン拡張)機能
動画生成AIの最大の弱点であった「尺の短さ」を解消する機能です。生成した数秒のクリップの最終フレームを読み取り、その状況を引き継いだ次のアクションをシームレスにつなげて生成します。
これら3つの機能が組み合わさることで、途切れがちな短尺動画を連ねて本格的なストーリー映像を組み立てられます。
Google VidsでOmni 1.1 Flashを起動する具体的な使い方と手順とは?
Google VidsでOmni 1.1 Flashを動かす手順は極めてシンプルです。Googleアカウントにログインした状態でブラウザから操作します。
ステップ1: Google Vidsへアクセスする
パソコンのブラウザのアドレスバーに「vids.new」と入力してEnterキーを押します。新しいGoogle Vidsのプロジェクト画面が立ち上がります。
ステップ2: 生成メニューから「Create AI videos」を選ぶ
画面左側のサイドパネルまたは作成メニューから「Create AI videos」を選択します。専用のプロンプト入力画面とアップロード用スロットが表示されます。
ステップ3: 元画像をアップロードして指示文を入力する
動かしたい写真やイラストをドラッグ&ドロップで配置します。プロンプト欄に動かしたい内容を日本語または英語で入力します。解像度(720p/1080p)やアスペクト比(16:9や9:16)を選択し、生成ボタンを押します。
数分待機すると、生成されたクリップがタイムラインへ自動挿入されます。プレビューを確認し、必要に応じてテキスト字幕やBGMをその場で追加できます。
狙った動きを引き出すプロンプト作成の具体例と記述ルール
Omni 1.1 Flashで思い通りの動画を生成するには、プロンプトの組み立て方に一定のコツが必要です。被写体の状態、カメラの視点移動、環境光の3要素を分けて書くことが成功への近道です。
次の表は、実務で頻出するシーン別のプロンプト記述例です。
| 目的・用途 | 入力画像の例 | 推奨プロンプト(指示文)の記述例 |
|---|---|---|
| EC商品の演出 | 化粧品ボトルの白バック写真 | 「水滴がついたボトルを固定したまま、背景に微細な水飛沫と涼しげな青い光の粒子を流す。カメラは正面からゆっくりズームイン。」 |
| イベント告知 | 飲食店の料理写真 | 「皿の上の肉料理から湯気が立ち上り、背後のキャンドルライトが柔らかく揺らめく。シネマティックな暖色の照明。」 |
| サービス紹介 | モバイルアプリのモックアップ画像 | 「スマートフォンの画面が明るく点灯し、UIのグラフが下から上へ滑らかに伸長する。背景は清潔感のある白グラデーション。」 |
| 採用・コーポレート | オフィスの会議室写真 | 「窓の外から柔らかな朝の光が差し込み、デスク上の観葉植物の葉が風でわずかに揺れる。カメラを右方向へスローパン。」 |
主語を省略せず、動かす対象と動かさない背景を明確に区別して指示すると、映像の破綻が起きにくくなります。
Extend機能で動画を拡張して長尺シーンを作る実践テクニック
数秒の短いクリップだけでは、伝えたいメッセージを十分に表現しきれないケースがあります。その際に威力を発揮するのが「Extend(拡張)」機能です。
Extend機能を使うと、直前に生成されたクリップの最後のコマ(ラストフレーム)の被写体位置と明暗をAIが自動計算します。そこから自然につながる後続の映像を生成するため、場面転換のつなぎ目がぎこちなくなりません。
具体的な拡張手順は以下の通りです。
- タイムライン上で生成済みのクリップを選択します。
- クリップのプロパティメニューから「Extend video」をクリックします。
- 後続シーンで起こしたい変化を指示文として入力します(例:「人物が立ち上がって窓の方へ歩き出す」)。
- 生成を実行すると、元のクリップの末尾に新しい映像が自動で結合されます。
被写体のポーズや部屋の間取りを維持したまま場面を展開できるため、数十秒単位のプレゼンテーション導入映像を破綻なく構築できます。
Omni 1.1 Flashと他の動画生成AI(Wan 3.0・Veo 3.1)の決定的な違いとは?
動画生成AIの領域では、各社から個性的なモデルが登場しています。Googleが展開する本格シネマ向けモデル「Veo 3.1」、Alibabaが開発したオープンなマルチモーダルモデル「Wan 3.0」、そして「Omni 1.1 Flash」はそれぞれ立ち位置が異なります。
次の表は、主要な動画生成モデルの設計思想と特徴を比較したものです。
| 比較項目 | Omni 1.1 Flash | Google Veo 3.1 | Alibaba Wan 3.0 |
|---|---|---|---|
| 主用途 | プレゼン・業務動画の迅速作成 | 映画・CMレベルのシネマティック映像 | 多彩なクリエイティブ制作・研究 |
| 提供場所 | Google Vids(Webブラウザ) | Google Flow / Vertex AI API | オープンウェイト / クラウド環境 |
| 利用料金 | 無料(標準機能内) | 秒課金(Standard $0.40/秒〜) | ホスティング環境に応じた実費 |
| 操作難易度 | 初心者向け(直感UI) | 中上級者向け(プロ仕様) | 上級者向け(導入知識が必要) |
| 編集機能 | Extend・スライド統合 | 高度なカメラ制御・4K出力 | キーフレーム制御・動画参照 |
| 強み | オフィスツール連携と導入コストの低さ | 圧倒的な映像美と長時間の物理整合性 | モデル構造の柔軟性とカスタマイズ性 |
Veo 3.1が映画のような最高峰の画質を追求する有料プロ向けツールであるのに対し、Omni 1.1 Flashはオフィスワーカーが日常の業務の中で迷わず使える手軽さを最優先に設計されています。
動画生成の最新動向を把握するなら、AI動画生成ツールの全体像を眺めておくと各ツールの強みがつかみやすくなります。
音声モデル「Gemini 3.8 Flash-Lite TTS」連携で広がる音声合成の未来
Google Vidsでは映像生成だけでなく、ナレーション音声の自動付与機能も急速に進化しています。公式のアナウンスによると、高精度な音声合成モデル「Gemini 3.8 Flash-Lite TTS」が近くGoogle Vidsへ統合される予定です。
これまでの動画制作では、映像を生成した後に別ソフトでナレーション音声を録音または合成し、タイムライン上で手作業で位置合わせを行う必要がありました。
Gemini 3.8 Flash-Lite TTSが統合されると、入力した原稿テキストから自然な抑揚のナレーションが生成され、Omni 1.1 Flashが作ったクリップの長さに合わせて自動配置されます。映像の動きと話すタイミングがワンストップで同期する世界が近づいています。
AIによる音声生成や文字起こしの技術動向については、AI音声ツールの最新一覧で基本を押さえておくと全体の流れを理解しやすくなります。
業務で導入する際のメリットと注意すべき制限事項
Omni 1.1 Flashは業務効率を大幅に引き上げる可能性を秘めていますが、万能ではありません。実務で運用する際は、強みと弱点の双方を客観的に見極めておく必要があります。
導入する主なメリット
- 外注費と手間の削減: 簡単な製品紹介や社内周知の映像を、デザイナーに依頼することなく社内で短時間に試作できます。
- Google環境との親和性: Googleドライブ内の画像アセットをそのまま読み込めるため、素材の移動や管理に手間がかかりません。
- 追加コストゼロ: Googleアカウントがあれば追加料金なしで利用できるため、予算確保の社内ハードルがありません。
現状の注意点と制限
- 細かな指先や文字の再現: 静止画内の小さな文字を動かすと、文字の輪郭が滲んだり形状が崩れたりする場合があります。
- 長時間の複雑なストーリー: Extend機能で拡張できるものの、数十カットに及ぶドラマ仕立ての映像では、徐々に登場人物の顔立ちや背景の整合性が失われる傾向があります。
用途を10秒から30秒程度のワンポイント映像やアイキャッチに絞ることで、これらの弱点を回避しながら最大の効果を得られます。
他の生成AIツールと組み合わせて動画クオリティを底上げする連携術
Omni 1.1 Flashは画像を入力として受け取るため、最初に投入する静止画の品質が最終的な動画クオリティを大きく左右します。最初から動かすことを前提に、他の画像生成AIでベース画像を生成しておくワークフローが効果的です。
リアルで破綻の少ない静止画ベースを用意したい場合は、高品質な画像生成で定評のあるFLUX.1の使い方を参考にして高解像度アセットを準備すると仕上がりが格段に良くなります。
さらに、自社サーバーで独自の画像生成パイプラインを運用している現場なら、AUTOMATIC1111の環境構築を組み合わせることで、自社ロゴや特定キャラクターの構図を保った静止画を安定して量産できます。
出来上がった動画素材の公開作業や社内配布を自動化したい場合は、オープンソースで柔軟な連携が組めるn8nの運用手順を活用すると、動画生成後のワークフロー全体を効率化できます。
AI PICKS編集部の判定
Omni 1.1 Flashに対する編集部の見立ては、「日常業務の動画素材づくりにおいては圧倒的な一択」です。
映像の絶対的な解像感や映画のような光の階調表現では、有料APIモデルであるVeo 3.1のほうが上回っています。しかし、プレゼン資料に動きを添えたり、SNS向けの簡単な製品告知動画を作ったりする現場において、数秒の動画に高額な料金を支払う運用は定着しにくいのが現実でした。
ブラウザのGoogle Vidsを開くだけで、手持ちの画像から1080pの動画を無料で生成できる手軽さは破格です。ツールの切り替えを強いられず、Google Workspaceの共有環境の中で完結する点も重宝します。凝った長編映画を作る用途には正直イマイチですが、社内プレゼンやSNS運用の現場で素材不足に悩んでいるなら、迷わず導入すべき実用モデルと判定します。
よくある質問(FAQ)
Q. Omni 1.1 Flashは本当に無料で使い続けられますか?
A. Googleアカウント所持者であれば、Google Vids内で追加料金なしで利用可能です。ただし、将来的な大量生成や企業向けの高度な機能については、Google Workspaceのプラン体系に応じた利用制限が設定される可能性があります。
Q. 日本語のプロンプト(指示文)でも正常に動作しますか?
A. 日本語での指示入力に対応しています。より複雑なカメラワークや細かい質感のニュアンスを正確に伝えたい場合は、英語でプロンプトを入力したほうが指示の再現性が高まる傾向があります。
Q. 生成した動画はYouTubeや広告などの商用利用に使えますか?
A. Google WorkspaceおよびGoogleの利用規約に準拠した範囲で商用利用が可能です。ただし、入力する元画像自体の著作権や肖像権に問題がないか、第三者の権利を侵害していないかを必ず事前に確認してください。
Q. スマートフォンのアプリから直接操作できますか?
A. 現時点ではデスクトップPC向けのWebブラウザ(Google Chrome等)での利用が推奨されています。スマートフォン端末のブラウザからは機能が制限される場合があります。
Q. 写真だけでなくイラストやロゴ画像からでも動画化できますか?
A. イラスト、グラフィックデザイン、ロゴマークなどの静止画からも問題なく動画を生成できます。ロゴを動かす際は、形状が過度に歪まないようプロンプトで「ロゴの輪郭を固定したまま背景のみを動かす」といった明確な指示を添えるのがコツです。
Q. 1回あたりの生成で何秒くらいの動画クリップが作れますか?
A. 1回のプロンプト入力で生成されるクリップは数秒程度の短尺です。より長い動画に仕上げたい場合は、生成後にExtend機能を使って後続の動きを継ぎ足していく運用を行います。
あわせて見たいツール・カテゴリ
動画生成や関連するAIツールをさらに深掘りしたい方は、以下のページも参考にしてください。
次に読むならこれ: 静止画のクオリティを高めて動画生成の精度を底上げしたい方は、FLUX.1とは?料金・使い方・商用利用を画像生成AIの新王者で徹底解説をあわせて読むと、プロンプト設計の理解がより深まります。

