Sora の精度が低いと感じたら見直す設定とプロンプト改善5ステップ

Sora の精度が低いと感じたら見直す設定とプロンプト改善5ステップ

この記事のポイント Soraの出力が思った絵にならない原因は、8割がモデルではなく指示文と設定の側にあります。1カット1動作まで分解し、被写体・カメラ・光を分けて書くだけで再現率は目に見えて変わります。秒数と解像度の設定、参照画像の使い方、作り直しの回し方を5ステップに整理しました。それでも直らない苦手分野も先に線引きしておきます。

生成ボタンを押すたびに、頼んでいない動きが増える。人物の顔が途中で別人になる。看板の文字が読めない記号になる。Soraを触り始めて2週間くらいで、多くの人がこの壁に当たります。

原因のほとんどは、指示文が長すぎるか、逆に足りていないかのどちらかです。モデルを疑う前に、書き方と設定を疑ったほうが早い。

ここでは、精度が低いと感じたときに上から順に潰していく手順を5つに分けます。全部やらなくても構いません。ステップ1と2だけで直る失敗が、体感でいちばん多いからです。


Soraの精度が低いと感じる原因はどこにある?

Soraの精度が低いと感じる原因はどこにある?

指示文の情報量ではなく、情報の並べ方と1本あたりの要求量が原因になっているケースが大半です。

Soraの精度とは、指示文で伝えた内容が動画のどこまで再現されるかの一致度です。「きれいな映像が出るかどうか」ではありません。ここを分けて考えないと、改善の打ち手がずれます。

映像としては破綻していないのに「違う」と感じるとき、たいてい次のどれかが起きています。

  • 1本の指示に動作を3つ以上詰め込んでいる
  • カメラの位置と動きを書いていないので、モデルが勝手に決めている
  • 光の方向と時間帯が抜けていて、絵の印象が毎回変わる
  • 秒数に対して展開が多すぎ、動きが早送りになっている

どれも書き方の問題です。プロンプト(AIへの指示文)を長くすれば直る、という話ではありません。

そもそもSoraで何ができるのかを一度も整理していないなら、Soraの基本と使い方をまとめた記事に先に目を通しておくと、ここから先の設定の話が早く入ります。


「精度が低い」の正体を3つに分ける

「精度が低い」の正体を3つに分ける

不満の中身を分類すると、対処の順番が決まります。同じ「精度が低い」でも、直し方はまったく別です。

まとめると、次の3種類に分かれます。

種類症状の例主な原因効くステップ
指示ずれ頼んでいない人物や小物が出る指示文の構造ステップ1・2
一貫性の崩れ顔・服・背景が途中で変わる尺と参照素材ステップ3・4
物理の破綻手の指、液体、文字が壊れるモデルの苦手分野ステップ5と割り切り

つまり、指示ずれと一貫性の崩れは自分で直せます。物理の破綻は書き方では消えにくいので、構図で避けるのが正解です。

この切り分けができると、無駄なリトライが減ります。生成1本ごとにクレジットが減るタイプのサービスでは、この判断が費用に直結します。


ステップ1: 1カット1動作に絞る

1本の生成に動作を1つだけ入れる。これだけで指示ずれの半分は消えます。

やりがちなのは、こういう書き方です。

「カフェに入ってきた女性が席に座り、コーヒーを注文して、窓の外を見ながら微笑む」

動作が4つあります。5秒前後の尺にこれを入れると、モデルは全部を圧縮しようとして早回しになり、どの動作も中途半端になります。顔が変わるのもここが引き金。

分解するとこうなります。

  • カット1: 窓際の席に座る女性、手元のカップに視線を落とす
  • カット2: カップを持ち上げる手元のクローズアップ
  • カット3: 窓の外を見て、口元がゆるむ

3本生成して編集ソフトでつなぐ。遠回りに見えて、これがいちばん速いです。つなぎ作業だけならCapCutのような無料の編集ツールで足ります。

判断の目安は「動詞が2つ以上あったら分ける」。この1行を覚えておくだけで、成功率が変わります。

尺を長く取れるプランでも、動作を詰め込む方針は変えないほうが無難です。長尺は「1つの動作をゆっくり見せる」ために使うと効きます。


ステップ2: 被写体・カメラ・光を分けて書く

指示文を3つのブロックに分けて書くと、モデルが解釈を迷わなくなります。

Soraに限らず、動画生成AIは「何を」「どこから」「どんな光で」の3点が揃うと安定します。逆に、被写体の描写だけを盛っても絵は決まりません。

書き換えの前後を並べます。

ブロック弱い書き方直した書き方
被写体「かっこいい男性」「40代の男性、黒いウールコート、無精ひげ」
カメラ(書いていない)「胸から上のミディアムショット、ゆっくり前進」
「明るい感じ」「夕方の斜光、逆光ぎみ、背景に街灯のボケ」
空気感「おしゃれに」「35mmフィルム調、粒子あり、彩度は低め」

つまり、形容詞を減らして名詞と数字を増やす。「おしゃれに」は情報量ゼロです。

カメラ用語がわからなくても大丈夫です。使うのは実質この5つだけ。

  • ワイド(引き)/ミディアム(胸から上)/クローズアップ(顔や手元)
  • 固定/ゆっくり前進/ゆっくり後退
  • 手持ち風の微ブレ

光は「時間帯+方向」で書けば通ります。「朝の窓からの横光」「曇りの日の柔らかい光」「夜、ネオンの反射」。この3語セットが、雰囲気の再現率をいちばん上げます。

日本語で書くか英語で書くかは、正直どちらでも通ります。ただ、固有の映像用語(backlit、shallow depth of fieldなど)は英語のほうが解釈が安定しやすい。日本語の文章に用語だけ英語を混ぜる書き方で十分です。


ステップ3: 秒数と解像度の設定を見直す

尺と解像度は品質の設定であると同時に、破綻しやすさの設定でもあります。

長く生成するほど、途中で顔や服が変わる確率は上がります。10秒より5秒のほうが安定するのは、単純に「変わる余地」が少ないからです。精度に不満があるなら、いったん短くする。これが設定側の最短の打ち手です。

プランによって上限が変わるので、公開されている条件を整理します。

項目ChatGPT PlusChatGPT Pro
月額20ドル200ドル
最大解像度720p1080p
最大尺短尺中心最大20秒
同時生成1本最大5本
ウォーターマークダウンロード時に付くなし

つまり、SNS用の数秒素材ならPlusで足ります。Proが効くのは、同時に複数案を走らせて当たりを選ぶ運用をするときです。プランの中身は改定が入りやすいので、契約前にOpenAI公式の料金ページで最新を確認してください(2026年9月時点の内容)。

解像度を上げれば精度が上がるわけではない点も押さえておきたいところ。1080pにしても、指の破綻や文字化けは同じように起きます。上がるのは見た目の解像感だけです。

設定で効くのは「短くする」「同時に複数出す」の2つ。この順で試すと、無駄打ちが減ります。


ステップ4: 参照画像とキャラクター機能で顔と世界観を固定する

言葉だけで見た目を固定するのには限界があります。画像を渡したほうが速い。

Sora 2ではキャラクター関連の機能が強化され、同じ人物を別のカットでも保つ作り方がしやすくなりました。ストーリーボード機能やブレンド機能のように、複数カットを前提にした編集の入り口も用意されています。

顔と世界観を固定したいときの手順はこうです。

  • 1枚目に「主役の顔」がはっきり写った参照画像を用意する
  • 服装と背景は言葉で固定する(「同じ黒いコート、同じオフィスの窓際」)
  • カットごとに参照画像を差し替えない
  • 生成のたびに指示文の被写体ブロックはコピペで使い回す

参照画像がないなら、静止画側で先に主役を作るのが早いです。MidjourneyLeonardo AIで顔を1枚決めてから動画に持ち込む。この二段構えは、キャラクターものを作る人の定番になりつつあります。

ここまでの整理: 指示ずれはステップ1と2、一貫性はステップ3と4で潰せます。ここから先は「それでも出る破綻」の話です。直らないものを直そうとしてクレジットを溶かすのが、いちばんもったいない失敗。


ステップ5: 一発生成をやめて作り直しで詰める

1回で完成させようとせず、3回で寄せる前提に切り替えると、結果的に消費が減ります。

回し方はシンプルです。

  • 1回目: 短い指示で「構図と光」だけを見る
  • 2回目: 当たった構図の指示文に、被写体の細部を足す
  • 3回目: 動きの速度と表情だけを直す

毎回ゼロから書き直すのが、いちばん精度が上がらないやり方です。当たった指示文を残して、変える要素を1つに絞る。変数を1つずつ動かすと、何が効いたのかがわかります。

うまくいった指示文は、テキストファイルに残しておいてください。3か月後の自分が同じ試行錯誤を繰り返さずに済みます。

社内で動画企画を回しているなら、指示文の元になる企画の言葉が精度を決めます。打ち合わせの内容を正確な文字に落とすところから見直したい人には、議事録AIの実力差を比べた記事Fireflies系ツールの比較が役に立ちます。指示文の精度は、その前段の言葉の精度で決まる。


プロンプトを書き換えるとどれくらい変わる?

同じシーンでも、書き方を構造化するだけで再現率は体感で大きく変わります。

具体的な書き換え例を並べます。

目的改善前改善後
商品紹介「新商品のコーヒーをおしゃれに紹介する動画」「白い大理石の台の上のコーヒーカップ、湯気が立つ、真上からの俯瞰、固定カメラ、柔らかい自然光、5秒」
人物「笑顔の女性が話している」「30代女性のミディアムショット、正面、軽くうなずく、窓からの横光、背景はボケた観葉植物」
風景「きれいな海の映像」「早朝の砂浜、波が寄せる、水平線に朝日、カメラは低い位置で固定、青と橙のグラデーション」

つまり、改善後の指示文には形容詞がほとんどありません。名詞、位置、光、秒数。この4種類だけで書けます。

「おしゃれ」「かっこいい」「きれい」は、人によって指す絵が違う言葉です。モデルにとっても同じ。ここを具体語に置き換えるのが、いちばん効率のいい改善です。


それでも直らない失敗パターンは?

書き方では消えにくい弱点があります。避ける構図を選ぶのが現実的な対処です。

代表的なものを挙げます。

  • 画面内の文字: 日本語の看板やテロップは高確率で崩れます。文字は編集ソフトで後から載せる
  • 手と指: 細かい手作業のクローズアップは破綻しやすい。手元は引きで撮るか、動きを止める
  • 液体の注ぎ口: 注ぐ動作は物理が壊れやすい。注ぎ終わった状態から始める
  • 群衆: 大人数の顔は溶けます。人数を3人以下に抑える

Sora 2は物理シミュレーションの再現度が上がったと案内されていますが、それでも上の4つは鬼門のまま。指示文を工夫するより、企画の段階で外したほうが速いです。

ロゴや商標を画面内に描かせるのも避けてください。似て非なるものが出て、そのまま公開すると別のトラブルになります。ロゴは後載せが鉄則。

音声まわりを詰めたいなら、映像と音を分けて作るのが安定します。ナレーションはElevenLabsのような音声特化のサービスで別に作り、編集で合わせる。この分業のほうが、修正も速い。


有料プランを上げれば精度は上がる?

解像度と本数は上がりますが、指示の再現率そのものが劇的に変わるわけではありません。

Proが向いているのは、次のような使い方をする人です。

  • 1つの企画で5案を同時に走らせ、当たりを選びたい
  • 納品物にウォーターマークを残せない
  • 1080pの尺で20秒までを1本で作りたい

逆に、SNS用の数秒素材を週に数本作る程度なら、Plusで十分足ります。月200ドルの差を埋めるのは、本数を回す運用をしている人だけ。

精度に不満がある段階でProに上げるのは、たいてい順番が違います。 先に書き方を直す。それでも「同時に複数案を出したい」という不満が残ったときが、上げどきです。

料金と使い方の全体像はSora AIの使い方ガイドにまとめてあるので、プラン選びで迷ったら先にそちらを見てください。


Soraが向かない用途と、その場合の代わり

苦手分野は他のツールに逃がすほうが、時間もお金も浮きます。

用途別の相性を整理します。

やりたいことSoraの相性代わりの選択肢
実写風の短尺カット得意そのままSoraで
手持ち素材を動かす条件つきLuma AI / Runway
人物のリップシンク苦手HeyGen
長尺の説明動画苦手Descript などの編集寄りツール
大量に案を出すプラン次第Kling AI / Hailuo AI

つまり、Soraは「短くて質の高いカットを作る道具」として置くのが正解です。動画制作の全工程を1本で賄うツールではありません。

Soraと他サービスの絵作りの違いが気になるなら、Luma AIとSoraを並べて比べた記事が判断材料になります。同じ指示文でも、モデルによって得意な絵はかなり違う。


AI PICKS編集部の判定

Soraの精度に不満が出たとき、課金を増やすのは最後の手段です。効くのは圧倒的に指示文の構造化のほう。動詞を1つに絞り、被写体とカメラと光を分けて書く。この2つだけで直る不満が大半で、ここを飛ばしてPro(月200ドル)に上げるのは正直もったいないです。

設定側で本当に効くのは「短くする」の一手。長尺は一貫性の敵で、10秒より5秒のほうが顔も服も安定します。解像度を上げても指の破綻は消えません。ここを誤解したまま1080pで回し続ける人が多い印象です。

苦手分野の割り切りも重宝します。画面内の日本語文字、指のクローズアップ、注ぐ動作、群衆。この4つは書き方で戦うより、構図で避けて後工程に回すほうが速い。文字は編集ソフトで載せれば済む話です。

総じて、短尺カットの質は圧倒的です。ただし動画制作を丸ごと任せる道具ではありません。Soraで素材を作り、編集と音声は別のツールで仕上げる。この分業に切り替えた時点で、精度の悩みは半分くらい消えます。


よくある質問(FAQ)

Q. 日本語のプロンプトでも精度は落ちませんか

日常的な描写であれば日本語で問題ありません。落ちやすいのは、映像特有の用語を日本語に訳したときです。「浅い被写界深度」よりshallow depth of fieldのほうが解釈が安定します。日本語の文章に用語だけ英語を混ぜる書き方が実用的です。

Q. プロンプトは長いほうがいいですか

長さではなく構造です。300字の散文より、被写体・カメラ・光・秒数を分けて書いた100字のほうが再現率は上がります。修飾語を足すより、あいまいな形容詞を具体語に置き換えるほうが効きます。

Q. 同じ人物を複数のカットで使い回せますか

参照画像とキャラクター関連の機能を使えば寄せられます。ただし完全一致は期待しないほうがいいです。カットをまたぐ場面では、正面のアップを続けず、引きや後ろ姿を挟むと違和感が目立ちにくくなります。

Q. 生成した動画は商用利用できますか

プランと使った素材の権利で条件が変わります。Plusはダウンロード時にウォーターマークが付くため、そのまま納品物に使える場面は限られます。公開前に必ず利用規約を確認してください。

Q. 何度作り直しても同じ失敗が出ます

指示文のどこかにモデルが強く反応している語が残っています。指示文を半分に削って、どの要素が失敗を呼んでいるかを切り分けてください。全部を書き直すより、1要素ずつ消すほうが原因にたどり着きます。

Q. 生成に失敗したときもクレジットは消費されますか

サービス側の扱いはプランや時期で変わります。無駄打ちを減らす意味でも、本番の指示文をいきなり長尺で回さず、短い尺で構図を確認してから伸ばす手順をおすすめします。

Q. 無料で試す方法はありますか

2026年時点の案内は有料プラン前提の内容が中心です。無料枠の有無は変動しやすいため、契約前に公式の案内で最新の条件を確認してください。試すだけなら、他社の動画生成サービスの無料枠を触って感覚をつかむ手もあります。


あわせて見たいツール・カテゴリ

指示文を直しても物足りないときは、道具の相性を疑う番です。目的別に見比べてみてください。

  • Sora: 料金と機能の最新状況をまとめたツールページ。プラン改定が入りやすいので契約前の確認先に
  • Runway: 手持ちの映像を加工する工程が多い人はこちらのほうが噛み合います
  • Luma AI: 写真1枚から動かす用途で強い。静止画資産が多い人向け
  • Kling AI: 案出しの本数を回したいときの選択肢
  • Veo: 実写寄りの画作りを比較検討するときに
  • 動画生成AIのカテゴリ一覧: 用途別に何があるかをまとめて眺めたいとき
  • 動画生成AIの評価一覧: 各サービスの評価を横並びで確認できます
  • 画像生成AIのカテゴリ: 参照画像を自作する工程を足したい人はここから

次に読むならこれ。Soraの基本と使い方をまとめた記事を通しで読むと、今日直した指示文がどの設定と噛み合っているかがはっきりします。設定の意味がわかると、作り直しの回数はさらに減ります。

Luma AI icon
Luma AI無料プランあり

Luma AIは、Dream MachineとPhoton系モデルを通じて、テキストや参考画像から高品質な画像・動画を生成できるAIクリエイティブツールです。プロンプト入力による画像生成に加え、アスペクト比の指定、既存画像を参照したバリエーション作成、人物やキャラクターの一貫性を保つ参照機能に対応しています。生成したビジュアルはDream Machine上で動画化や編集の起点にもでき、Luma APIを使えば自社サービスや制作ワークフローへ画像・動画生成機能を組み込めます。広告、映像、ゲーム、SNS向けのビジュアルを短い試作サイクルで作りたいクリエイターや開発者に向いており、画像生成からモーション表現まで同じ環境で扱える点が強みです。

3.69/5.00
詳細を見る →

各ツールの公式サイト(一次情報)

料金・機能・対応範囲は各社公式が一次情報です。本記事は公開時点の検証に基づきますが、最新かつ正確な条件は必ず各公式ページで確認してください。