Midjourneyの発表内容

画像生成AIを手がけるMidjourneyは、新しい生成機能「Thinking Mode」のテスト提供を始めました。同社のWeb版である「Alpha」サイト(alpha.midjourney.com)で利用できます。

この機能は、指示文の再現性や画像の統一感、画像内の文字の描写精度を高めるための仕組みです。生成した画像の詳細画面を開き、右下の「Rerun (Thinking)」ボタンを押すと再実行できます。

同社は今後、この機能を通常の生成手段として広く提供するか、生成後に追加で思考を深める選択肢として実装するかを検討しています。

画像内に正確な文字を入れたい人や、複雑な指定のイラストを作りたい人は、指示通りの画像を得やすくなります。

つまり、どういうこと?

ざっくり言うと、AIが画像を描く前に「ちょっと考えてから描く」機能です。これまでの画像生成は、頼まれた瞬間に一発で描き切る職人のような動きでした。今回のモードは、下書きの前に指示を読み返し、構図や文字の並びを頭の中で整理してから筆を動かすような仕組みです。

編集部の見方

文章生成AIでは定着した思考プロセスが、いよいよ画像生成にも持ち込まれました。画像を生成し直すボタンに「Thinking」と添えられている画面は、なかなか新鮮です。

一発勝負から熟考へ。

文字崩れの少なさは仕事のデザイン制作で直結する要素なので、この方向性の改善はかなり重宝します。今後は通常の生成枠と生成時間のバランスがどう落ち着くかが焦点になりそうです。まずはDiscord版への反映や、次のメジャーアップデートでこの思考機能が標準搭載されるかを見届けたいところです。

誰に関係するか

画像内に文字を入れたポスターや挿絵を制作している人は、文字の崩れを防ぎやすくなり、指定通りの画像を効率よく作れるようになります。