定義
テキスト・トゥ・モーション(Text-to-Motion)とは、テキストで記述した動作指示から人物やキャラクターの動きそのものを生成する動画・モーション生成技術のこと。
テキスト・トゥ・モーション (Text-to-Motion)とは(詳しく解説)
Text-to-Motionは、自然言語のテキストプロンプトからCG的な骨格モーションや人物の動き自体を生成する技術で、完成映像を出力する一般的なテキスト動画生成AIとは異なり、モーションデータ(関節角度や軌跡)を出力対象とする点が特徴とされる。生成したモーションは3Dキャラクターやアバターに適用でき、ゲームやアニメーション制作のリグに読み込んで使う運用が広く採用されている。2026年時点の実運用では、歩く・座るといった単純な動作は自然に生成できる一方、複数人が絡む動作や道具を使う所作は不自然な貫通や破綻が起きやすいと現場で指摘されており、最終的な手直しを前提にした運用が現実的とされる。コスト面では、モーションキャプチャスタジオを都度手配するより相場感として安く済むケースが多いが、生成回数に応じた従量課金や破綻モーションを選別・修正する人的コストが積み上がりやすい。現場での選び方としては、プロトタイプや大量のバリエーション出しにはText-to-Motionを、最終納品クオリティが求められるカットには従来のモーションキャプチャや手付けアニメーションを併用する使い分けが現実的とされる。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「テキスト・トゥ・モーション (Text-to-Motion)とは」 https://aipicks.jp/glossary/text-to-motion
テキスト・トゥ・モーション (Text-to-Motion)の使用例
- ゲーム制作でNPCの「歩いて棚に近づき荷物を持ち上げる」という指示から骨格モーションを生成し、リグに読み込んでそのまま使う。
- 3Dアバター配信で、台本のセリフに合わせた身振り手振りのモーションをText-to-Motionで下書きとして先に作る使い方。