Anthropic、ブラウザ拡張「Claude for Chrome」をベータ提供 攻撃成功率1%に低減
- AnthropicはWebブラウザ拡張機能「Claude for Chrome」をベータ版として提供しました。
- 2025年11月24日から提供を始めています。
- 有料のMaxプランを利用している人が対象です。

Anthropicは2025年11月24日、Chrome拡張機能「Claude for Chrome」の提供範囲をベータ版へ拡大しました。最新モデルの「Claude Opus 4.5」を組み合わせ、安全対策を強化しています。
この拡張機能は、AIがWebブラウザ上でページの移動やボタンのクリック、フォームの入力を自律して進めます。訪問先のWebページに悪意ある指示を埋め込むプロンプトインジェクション(不正な指示による乗っ取り攻撃)への耐性を高めました。
強化学習による訓練や分類器の改良により、攻撃成功率を1%まで抑え込みました。安全対策の検証には専門家によるレッドチーム(欠陥を突いて安全性を検証する専門部隊)も参加しています。
Maxプランの利用者は、受信トレイの確認や返信案の作成といった日々のブラウザ作業をClaudeに任せられます。悪意ある外部指示による機密情報の流出を防ぎながら、業務の自動化を進められます。
ひらたく言うと、怪しいWebサイトの罠に引っかからないブラウザ自動操作機能です。
これまでのAIは、Webサイトに白い文字などで隠された不正な命令を読むと、勝手に社内メールを外部に転送してしまう危険がありました。今回はその攻撃を察知して無視する防壁を固め、安全にWeb巡回を代行できるようにしました。

攻撃成功率を1%まで抑えた成果を出しつつ、Anthropic自身がリスクは残ると公式に認めている点に筆者は目を引かれました。100回に1回でも社内データが抜かれれば大事故になるため、隙を包み隠さず公表する姿勢は納得できます。
安全対策の泥臭さ。
ただ、さすがに1%の隙が残る段階では、会社の口座や顧客情報を扱う作業を任せるのはちょっと怖いです。まずは社内メールの一次選別など、万が一の被害が小さい業務で試したい人に向いています。次の冬に予定されるアップデートで、この1%のリスクがどこまで削られるかを見たいです。
Maxプランを利用している人は、不正な攻撃による情報流出を防ぎながらブラウザ上の作業をClaudeに任せられるようになります。
出典: Anthropic ↗/ ITmedia AI+も報道

