Claudeの発表内容

Anthropicは2026年9月29日、中国Z.aiのAIモデル「GLM-5.3」に関するサイバーセキュリティの評価結果を公開しました。同モデルが「Claude Mythos Preview」に近い水準のサイバー攻撃能力を持つ一方、安全対策が不十分であると警告しています。

脆弱性を突く攻撃コードを作成するテストにおいて、「GLM-5.3」は410回の試行のうち50回で成功しました。これは「Claude Mythos Preview」の410回中56回に迫る数値です。オープンソース製品を対象にしたテストでも、4%の確率でシステム全体の制御を奪うコードを作成しました。

Anthropicのテストでは、「GLM-5.3」の安全対策は簡単な手法によって64%から100%の確率で回避されました。対策を施した「Claude」ではこれらの攻撃を防げたのに対し、誰でもダウンロードできる同モデルには実効性のある制限がありません。

悪意を持つ攻撃者の能力が高まる一方、この高い分析能力はシステムの安全性を高める防御側の作業にも役立ちます。防御側はAIを活用し、悪用される前にソフトウェアの欠陥を発見して対策を進めることができます。

つまり、どういうこと?

ざっくり言うと、専門家並みの攻撃技術を持つAIが、鍵もかけられずにネット上に置かれている状態です。たとえるなら、ピッキングの達人の技術をそのまま覚えた道具が、身元確認なしで誰でも持ち出せるようなものです。守る側にとっては点検に役立つ一方、悪用への警戒が一段と求められます。

編集部の見方

安全策の突破率が最大100%という数字には、さすがに背筋が寒くなりました。Anthropicが厳格な審査のもとで一部の専門家にのみ配備してきた水準の能力が、誰でも入手できる形で出回ってしまったためです。

守る側のスピード勝負。

ただ、この流れ自体を止めるのはかなり難しそうです。高性能なモデルが一般に公開された以上、防御側も同じ道具を使ってシステムの穴を先に見つけ出すしかありません。秋以降に予定される各国の安全性評価機関による更新で、オープンモデルへの具体的な運用指針が示されるかを見ておきたいところです。

誰に関係するか

社内システムの防御を担当している人は、高度な能力を持つAIを活用して悪用前に脆弱性を発見できるようになります。

出典: Anthropic ↗/ GIGAZINEも報道