OmniHuman (人物動画生成)
読み: おむにひゅーまん
最終更新: 2026-07-27・AI PICKS編集部
定義
OmniHumanとは、1枚の人物画像と音声や動きの参照データを組み合わせ、口の同期や身振りまで含む自然な全身動画を生成するAI技術のこと。
OmniHuman (人物動画生成)とは — 詳しく解説
OmniHumanは静止画1枚と音声・動作参照などの入力を組み合わせ、口の同期や身振り、視線まで含む自然な全身動画を生成する人物動画生成AIの一種とされる。SoraやRunwayのような汎用動画生成と異なり、実在の人物画像を起点に動かす点が特徴で、広告・研修動画・多言語吹き替えなど現場での活用が2026年時点で広がっている。一方で実運用では、動画が長尺になるほど手指や背景の一貫性が崩れやすく、カット単位での修正作業が発生する点や、本人の許諾なく人物画像を使うと肖像権・なりすましのリスクが生じる点が落とし穴とされる。商用利用のコストは生成尺と解像度に応じた従量課金が主流で、サービス間の相場感を比較しつつ、口パク精度や日本語音声との相性、商用利用規約の範囲を基準に選ぶのが現実的とされる。
OmniHuman (人物動画生成)の使用例
- 社員写真1枚と原稿音声を入力し、研修動画用に口の動きが同期した挨拶動画を生成する使い方が想定される。
- 既存の商品モデル写真から、多言語吹き替え版のプロモーション動画を短時間で作る用途に向くとされる。
OmniHuman (人物動画生成)に関連するAIツール
関連用語
「動画生成」の他の用語
OpenAI の動画生成 AI。 ChatGPT Pro で利用可能、 最大 20 秒の高品質動画を生成。
プロ向け AI 動画編集・生成スイート。 Gen-3 / Gen-4 で 映画品質の動画を生成。
VeoとはGoogle DeepMindが開発した動画生成AIモデルのこと。テキストプロンプトや静止画から高精細な動画を生成でき、物理的整合性と映像の時間的一貫性においてSoraと並ぶ業界最高水準を誇る。
Kling(可灵)とは、中国の快手(Kuaishou)が開発したAI動画生成モデルのこと。テキストや画像から最大2分・1080pの高品質動画を生成でき、SoraやRunwayと並ぶ有力な動画生成AIとして世界的に注目されている。
PikaとはテキストプロンプトやAI画像を入力するだけで3〜10秒の高品質な短尺動画クリップを自動生成できるAI動画生成プラットフォームのこと。
Luma Dream Machineとは、Luma AIが提供するテキストや画像から高品質な動画クリップを自動生成できるAIビデオ生成ツールのこと。物理的にリアルな映像と滑らかなカメラワークを特徴とする。
AI用語辞典をすべて見てみませんか
12カテゴリ・1063語以上を体系的に整理しています
辞典トップへ