テキスト・トゥ・モーション (Text-to-Motion)
読み: てきすととぅもーしょん
最終更新: 2026-07-22・AI PICKS編集部
定義
テキスト・トゥ・モーション(Text-to-Motion)とは、テキストで記述した動作指示から人物やキャラクターの動きそのものを生成する動画・モーション生成技術のこと。
テキスト・トゥ・モーション (Text-to-Motion)とは — 詳しく解説
Text-to-Motionは、自然言語のテキストプロンプトからCG的な骨格モーションや人物の動き自体を生成する技術で、完成映像を出力する一般的なテキスト動画生成AIとは異なり、モーションデータ(関節角度や軌跡)を出力対象とする点が特徴とされる。生成したモーションは3Dキャラクターやアバターに適用でき、ゲームやアニメーション制作のリグに読み込んで使う運用が広く採用されている。2026年時点の実運用では、歩く・座るといった単純な動作は自然に生成できる一方、複数人が絡む動作や道具を使う所作は不自然な貫通や破綻が起きやすいと現場で指摘されており、最終的な手直しを前提にした運用が現実的とされる。コスト面では、モーションキャプチャスタジオを都度手配するより相場感として安く済むケースが多いが、生成回数に応じた従量課金や破綻モーションを選別・修正する人的コストが積み上がりやすい。現場での選び方としては、プロトタイプや大量のバリエーション出しにはText-to-Motionを、最終納品クオリティが求められるカットには従来のモーションキャプチャや手付けアニメーションを併用する使い分けが現実的とされる。
テキスト・トゥ・モーション (Text-to-Motion)の使用例
- ゲーム制作でNPCの「歩いて棚に近づき荷物を持ち上げる」という指示から骨格モーションを生成し、リグに読み込んでそのまま使う。
- 3Dアバター配信で、台本のセリフに合わせた身振り手振りのモーションをText-to-Motionで下書きとして先に作る使い方。
テキスト・トゥ・モーション (Text-to-Motion)に関連するAIツール
関連用語
「動画生成」の他の用語
OpenAI の動画生成 AI。 ChatGPT Pro で利用可能、 最大 20 秒の高品質動画を生成。
プロ向け AI 動画編集・生成スイート。 Gen-3 / Gen-4 で 映画品質の動画を生成。
VeoとはGoogle DeepMindが開発した動画生成AIモデルのこと。テキストプロンプトや静止画から高精細な動画を生成でき、物理的整合性と映像の時間的一貫性においてSoraと並ぶ業界最高水準を誇る。
Kling(可灵)とは、中国の快手(Kuaishou)が開発したAI動画生成モデルのこと。テキストや画像から最大2分・1080pの高品質動画を生成でき、SoraやRunwayと並ぶ有力な動画生成AIとして世界的に注目されている。
PikaとはテキストプロンプトやAI画像を入力するだけで3〜10秒の高品質な短尺動画クリップを自動生成できるAI動画生成プラットフォームのこと。
Luma Dream Machineとは、Luma AIが提供するテキストや画像から高品質な動画クリップを自動生成できるAIビデオ生成ツールのこと。物理的にリアルな映像と滑らかなカメラワークを特徴とする。
AI用語辞典をすべて見てみませんか
12カテゴリ・863語以上を体系的に整理しています
辞典トップへ