ChatGPT、GPT-6 Astraを公開 54,000件超の社内タスクで安全性評価
- GPT-6 Astraが広く提供されました。
- 54,000件超の社内タスクで安全性を評価しました。
- 職場でAIエージェントを使う人が対象です。

OpenAIは「ChatGPT」の新モデル「GPT-6 Astra」を公開しました。OpenAIはこのモデルを、同社が広く提供した中で最も高性能なモデルと位置付けました。
「GPT-6 Astra」は、Preparedness Frameworkのサイバー能力でCritical (重大なリスク水準) に達しました。適切なツールと権限がある場合、未知の安全上の欠陥を見つけられます。人が各手順を案内しなくても、保護されたシステムへの新しい攻撃方法を作れます。
OpenAIは悪用や意図しない動作を防ぐため、保護策を強化しました。内部開発では、より厳しい隔離、チェックポイント暗号化、CoT (推論の過程) を含む監視、利用前の評価を導入しました。
「GPT-6 Astra」は、GPT-5.6 Solより脱獄 (安全制限を外す試み) に強いモデルです。54,000件超の社内Codexタスクを使った模擬評価では、重大度の高い不適切な動作の警告がGPT-5.6 Solの約半分でした。
ブラウジングや職場のコンピューター操作でも、安全性を重視しています。不正な取引、データ損失、過剰なアクセス、制御の回避につながる行動は、GPT-5.6 Solより起きにくくなりました。
職場でAIエージェントに調査や操作を任せている人は、より強い監視と安全対策の下で「ChatGPT」を使えるようになります。
出典: OpenAI ↗/ ITmedia AI+も報道

