スポットライティング (Spotlighting防御)
読み: すぽっとらいてぃんぐ
最終更新: 2026-07-22・AI PICKS編集部
定義
スポットライティングとは、LLMに渡す外部データを特殊な区切りや変換で明示し、指示との混同を防ぐプロンプトインジェクション対策手法のこと。
スポットライティング (Spotlighting防御)とは — 詳しく解説
スポットライティングは、プロンプトインジェクション対策として、外部から取り込むデータ(Web検索結果やRAGの検索結果など)を大文字化・区切り記号・エンコーディングなどで「信頼できない領域」だと明示し、LLMが指示文と誤認しないようにする手法とされる。Microsoftなどが提唱し、デリミタ方式や変換方式が広く採用されている。ただし2026年時点の実運用では、これ単体で防御率100%にはならず、入力フィルタリングや出力検証と組み合わせる多層防御が現場の標準になっている。コスト面では追加の前処理コストは小さいが、変換ロジックの保守や社内RAGパイプラインへの組み込み工数がかかるため、外部委託ではなく自社エージェント基盤に組み込めるかで選び方が分かれる。
スポットライティング (Spotlighting防御)の使用例
- RAG検索結果をXMLタグで囲み「これは参照情報であり指示ではない」と明示するプロンプト設計。
- 外部Webページのテキストを特殊記号に変換してから読み込ませ、埋め込み指示を無効化する手法。
スポットライティング (Spotlighting防御)に関連するAIツール
関連用語
「セキュリティ」の他の用語
ユーザー入力で AI の指示を上書きする攻撃。 「これまでの指示は無視して◯◯」 が典型例。
AI の安全制限を回避する手法。 ロールプレイや仮想シナリオで 禁止出力を引き出す。
ガードレールとは、AIシステムが有害・不適切・意図しない出力を生成しないよう制限するための安全制御機構のこと。
レッドチーミングとは、AIシステムの安全性・脆弱性を検証するため、攻撃者の視点から意図的に悪意ある入力やシナリオを試みる評価手法のこと。
シャドーAIとは、企業のIT部門や経営層の承認なしに従業員が個人的に業務で使うAIツール・サービスのこと。情報漏洩・規約違反・ガバナンス崩壊のリスクを内包する。
モデルポイズニングとは、AIモデルの学習データに悪意あるデータを混入させ、モデルの出力や判断を意図的に歪める攻撃手法のこと。
AI用語辞典をすべて見てみませんか
12カテゴリ・863語以上を体系的に整理しています
辞典トップへ