デュアルLLMパターン (Dual LLM Pattern)
読み: でゅあるえるえるえむぱたーん
最終更新: 2026-07-25・AI PICKS編集部
定義
デュアルLLMパターンとは、権限を持つ「特権LLM」と外部データを読む「隔離LLM」を分離し、プロンプトインジェクションによる権限奪取を防ぐエージェント設計手法のこと。
デュアルLLMパターン (Dual LLM Pattern)とは — 詳しく解説
デュアルLLMパターンは、Simon Willisonらが提唱したAIエージェントのセキュリティ設計原則で、外部システムを操作する「特権LLM」と、信頼できない外部データを解析する「隔離LLM」を明確に分離する構成を指す。隔離LLM側はツール呼び出し権限を持たないため、悪意ある指示が埋め込まれたWebページやメール本文を読み込んでも、プロンプトインジェクションが特権LLM側の行動には波及しにくいとされる。2026年時点の実運用では、外部データ読込とツール実行を1つのLLMに任せる単一構成が依然として多く、分離コストを敬遠してそのまま本番投入している現場も目立つ。実装には仲介ロジックやスキーマ検証の追加が伴うため、単一LLM構成に比べ開発工数・API呼び出しコストの両面で相場感として1.5〜2倍程度の見積りが必要になりやすい。選定の目安は未検証の外部入力を扱うかどうかで、社内限定ツールなど外部入力を扱わない構成なら単一LLMで十分と判断する現場も多いとされる。
デュアルLLMパターン (Dual LLM Pattern)の使用例
- 特権LLMが確定注文をAPIに送信する一方、隔離LLMは受信メールの本文を要約するだけでツールを呼び出す権限を持たない、という役割分担。
- 問い合わせフォームの自由記述文を隔離LLMが要約し、特権LLM側はその要約結果だけを見てCRM登録の可否を判断する設計。
デュアルLLMパターン (Dual LLM Pattern)に関連するAIツール
関連用語
「セキュリティ」の他の用語
ユーザー入力で AI の指示を上書きする攻撃。 「これまでの指示は無視して◯◯」 が典型例。
AI の安全制限を回避する手法。 ロールプレイや仮想シナリオで 禁止出力を引き出す。
ガードレールとは、AIシステムが有害・不適切・意図しない出力を生成しないよう制限するための安全制御機構のこと。
レッドチーミングとは、AIシステムの安全性・脆弱性を検証するため、攻撃者の視点から意図的に悪意ある入力やシナリオを試みる評価手法のこと。
シャドーAIとは、企業のIT部門や経営層の承認なしに従業員が個人的に業務で使うAIツール・サービスのこと。情報漏洩・規約違反・ガバナンス崩壊のリスクを内包する。
モデルポイズニングとは、AIモデルの学習データに悪意あるデータを混入させ、モデルの出力や判断を意図的に歪める攻撃手法のこと。
AI用語辞典をすべて見てみませんか
12カテゴリ・963語以上を体系的に整理しています
辞典トップへ