ツールシャドーイング (Tool Shadowing)
読み: つーるしゃどーいんぐ
最終更新: 2026-07-21・AI PICKS編集部
定義
ツールシャドーイングとは、複数のAIツールを同時接続した際、悪意あるツールの説明文が正規ツールの動作を上書き・誘導し、エージェントに意図しない処理をさせる攻撃手法のこと。
ツールシャドーイング (Tool Shadowing)とは — 詳しく解説
ツールシャドーイングは、AIエージェントが複数の外部ツール(MCPサーバーなど)を同時に読み込む環境で、悪意あるツールや汚染されたツールの説明文(description)やパラメータ定義を通じて、別の正規ツールの呼び出し方や解釈をひそかに書き換え、エージェントに意図しない挙動を取らせる攻撃手法を指すとされる。プロンプトインジェクションの一種として、ツール一覧を横断して解釈するLLMの性質を悪用する点が特徴とされる。実運用では、社内外の複数チームがそれぞれMCPサーバーを追加していく現場ほどリスクが見えにくくなりやすく、2026年時点では接続前のツール説明文レビューやサンドボックス実行、ツール出所の署名検証といった対策が広く採用されているとされる。導入コストは監査体制の構築に比重が置かれ、接続ツール数が増えるほど目視レビューの負荷が上がるため、自動スキャンとの併用が現場での現実的な選び方になっているとされる。
ツールシャドーイング (Tool Shadowing)の使用例
- 「請求書PDFを要約して」という指示のはずが、別サーバーのツール説明文により添付ファイル送信ツールへ横流しされ、外部URLへ本文が転送された。
- MCPサーバー追加時は、ツールのdescriptionに他ツールの呼び出しを誘導する文言が無いかレビューしてから接続する。
ツールシャドーイング (Tool Shadowing)に関連するAIツール
関連用語
「セキュリティ」の他の用語
ユーザー入力で AI の指示を上書きする攻撃。 「これまでの指示は無視して◯◯」 が典型例。
AI の安全制限を回避する手法。 ロールプレイや仮想シナリオで 禁止出力を引き出す。
ガードレールとは、AIシステムが有害・不適切・意図しない出力を生成しないよう制限するための安全制御機構のこと。
レッドチーミングとは、AIシステムの安全性・脆弱性を検証するため、攻撃者の視点から意図的に悪意ある入力やシナリオを試みる評価手法のこと。
シャドーAIとは、企業のIT部門や経営層の承認なしに従業員が個人的に業務で使うAIツール・サービスのこと。情報漏洩・規約違反・ガバナンス崩壊のリスクを内包する。
モデルポイズニングとは、AIモデルの学習データに悪意あるデータを混入させ、モデルの出力や判断を意図的に歪める攻撃手法のこと。
AI用語辞典をすべて見てみませんか
12カテゴリ・813語以上を体系的に整理しています
辞典トップへ