OpenAI、ChatGPTエージェントを対象に 50%以上再現のリスク報告を受付
- OpenAIは安全性バグバウンティを開始しました。
- ChatGPTエージェントを含む製品のリスクを扱います。
- 50%以上再現可能な乗っ取りなどを対象にします。

OpenAIは2026年3月25日、製品全体におけるAIの悪用や安全性リスクの特定に重点を置く、一般公開のセーフティバグバウンティプログラムを開始しました。従来のセキュリティバグバウンティを補完する取り組みです。
対象には、MCPを含むエージェント型リスクが含まれます。攻撃者のテキストがBrowser、ChatGPTエージェント、同様のエージェント型製品を乗っ取り、有害な操作やユーザーの機密情報漏えいを起こせる場合を扱います。この挙動は少なくとも50%の確率で再現可能である必要があります。
OpenAIのエージェント型製品が、OpenAIのウェブサイト上で許可されていない操作を大規模に実行する場合も対象です。上記に記載されていない潜在的に有害な操作も、現実的で重大な被害が見込まれる場合に受け付けます。
ジェイルブレイクは本プログラムの対象外です。ただし、ChatGPTエージェントやGPT-5におけるバイオリスク関連のコンテンツ問題など、特定の被害の種類に焦点を当てた非公開のバグバウンティキャンペーンを定期的に実施しています。
ChatGPTエージェントを検証する安全性研究者やセキュリティ研究者に関係します。
出典: OpenAI ↗/ ITmedia AI+も報道

