サンドボックス脱出 (Sandbox Escape)
読み: さんどぼっくすだっしゅつ
最終更新: 2026-07-24・AI PICKS編集部
定義
サンドボックス脱出とは、隔離実行環境に閉じ込められたプログラムやAIエージェントが、想定された制限を破ってホスト側のシステムやネットワークに不正アクセスできてしまう状態のこと。
サンドボックス脱出 (Sandbox Escape)とは — 詳しく解説
サンドボックスとは、悪意あるコードや信頼できない処理を本体システムから切り離して実行する隔離環境で、AIエージェントのコード実行機能やブラウザのプラグイン実行、コンテナ実行基盤などで広く採用されている。サンドボックス脱出は、この隔離境界の設定不備や実装の脆弱性を突いて、本来アクセスできないはずのファイルシステムやネットワーク、権限に到達してしまう事象を指す。2026年時点の実運用では、AIエージェントに任意コード実行ツールを持たせる構成が急増しており、コンテナの権限設定やファイルパス制限の緩さが脱出の入口になりやすいと指摘される。現場での選び方としては、単一プロセスの制限だけに頼らず、ネットワーク遮断やファイルシステムの読み取り専用化など多層の防御を重ねる設計が基本とされる。監査や第三者評価にかかるコストも踏まえ、隔離強度と開発速度のバランスを見極める判断が実務上の課題になっている。
サンドボックス脱出 (Sandbox Escape)の使用例
- AIコーディングエージェントにファイル操作権限を渡す前に、サンドボックスのネットワーク遮断設定を確認する。
- コンテナのマウント設定不備を突かれ、ホストのファイルシステムへ書き込みできてしまうケースが典型例とされる。
サンドボックス脱出 (Sandbox Escape)に関連するAIツール
関連用語
「セキュリティ」の他の用語
ユーザー入力で AI の指示を上書きする攻撃。 「これまでの指示は無視して◯◯」 が典型例。
AI の安全制限を回避する手法。 ロールプレイや仮想シナリオで 禁止出力を引き出す。
ガードレールとは、AIシステムが有害・不適切・意図しない出力を生成しないよう制限するための安全制御機構のこと。
レッドチーミングとは、AIシステムの安全性・脆弱性を検証するため、攻撃者の視点から意図的に悪意ある入力やシナリオを試みる評価手法のこと。
シャドーAIとは、企業のIT部門や経営層の承認なしに従業員が個人的に業務で使うAIツール・サービスのこと。情報漏洩・規約違反・ガバナンス崩壊のリスクを内包する。
モデルポイズニングとは、AIモデルの学習データに悪意あるデータを混入させ、モデルの出力や判断を意図的に歪める攻撃手法のこと。
AI用語辞典をすべて見てみませんか
12カテゴリ・913語以上を体系的に整理しています
辞典トップへ