Perplexity、AI基盤「SPACE」の安全検証結果を公開 108回のVM脱出試行で突破ゼロ
- PerplexityがAI実行基盤「SPACE」の安全性検証結果を公表しました。
- 検証結果の第1弾を公開し、判明した通信の欠陥も修正済みです。
- 自律的にプログラムを動かすAIエージェントの利用者が対象です。

Perplexityは自社のAI実行基盤「SPACE (安全な隔離環境)」の安全性検証レポートを公表しました。
実験では仮想環境からホストへの脱出を108回試みましたが、突破は0件でした。一方で、外部への通信を一部許可した環境では、54回中11回でネットワーク制限の迂回が確認されました。4つのAIモデルが制限を突破したため、Perplexityは欠陥を修正して再テストで防げることを確認しました。
Perplexityは問題が見つかった全社へ結果を通知しています。
長時間の作業をAIエージェントに任せる際、不正な動作や外部への情報漏洩を防ぎながら安全にプログラムを実行できます。
ざっくり言うと、AIにパソコンを渡して自由に作業させても、部屋の外へ逃げ出せないか実験したということです。たとえるなら、頑丈な個室に鍵をかけて新人を配置し、壁を壊して外に出られないかを試した形です。壁自体は破られませんでしたが、通気口から外と連絡を取るような通信の抜け道が見つかったため、すぐに塞がれました。

自社の安全性を誇るだけでなく、AIが通信の網をかいくぐった事実まで公表した点に筆者は驚きました。108回の試行で仮想マシンからの脱出がゼロだった堅牢さには、なるほどと唸らされます。
自律的に動くAIを現場へ導入する企業が増える中、実行環境の通信制限は今後の標準的なチェック項目になりそうです。隔離と通信の二重防壁。
エージェントに長時間の作業を任せたい人なら、自社の隔離環境が通信まで制御できているか見直すよい機会になります。次は各モデルがどう攻撃を仕掛けたのか、具体策が明かされる「Part II」の公開を待ちたいところです。
AIエージェントにプログラムの実行を任せている人は、外部への不正な通信や情報漏洩のリスクを抑えて安全に作業を継続できるようになります。

