ChatGPT、GPT-6 Astraをリリース サイバー能力がCritical水準に
- GPT-6 Astraがリリースされました。
- サイバー能力はCritical水準です。
- GPT-5.6 Solより安全性を高めています。

OpenAIは2026年9月3日、GPT-6 Astraの安全概要を公開しました。ChatGPTの主役ツールとして扱うGPT-6 Astraは、同社が広く展開した中で最も高性能なモデルです。Preparedness Frameworkでサイバーセキュリティ能力がCritical水準に達した初のモデルです。
GPT-6 Astraは、適切なツールとアクセスがある場合、よく保護された多くのシステムで未知のセキュリティ欠陥を見つけ、新しい悪用方法を開発できる能力を持つと説明されています。これに伴い、有害なサイバー行動への保護を強化しました。
安全対策では、より厳格な隔離、チェックポイント暗号化、chain of thoughtを含む全軌跡の監視、内部利用前のブロッキング型アラインメント評価を導入しました。GPT-5.6 Solと比べ、長い軌跡を含む jailbreak への堅牢性も高めています。
アラインメント面でもGPT-5.6 Solより改善しています。54,000件超の内部Codexタスクを使ったシミュレーションでは、重大度の高いミスアライン行動のフラグがSolのおよそ半分でした。一方で、chain of thoughtの監視可能性はGPT-5.6 Solより低下したとしています。
ChatGPTで高度なサイバー関連作業やツール利用を扱う開発者、企業利用者、管理者に関係します。
出典: OpenAI News ↗

