OpenAI、ChatGPTエージェント対象の安全性バグバウンティ開始 50%再現性を条件に
- OpenAIが安全性バグバウンティを開始しました。
- ChatGPTエージェントを含むリスクを扱います。
- 重大な悪用や安全性リスクの報告を受け付けます。

OpenAIは2026年3月25日、製品全体におけるAIの悪用や安全性リスクの特定に重点を置いた、一般公開のセーフティバグバウンティプログラムを開始しました。ChatGPTエージェントを含むエージェント型製品のリスクも対象です。
対象には、攻撃者のテキストが被害者のエージェントを乗っ取り、有害な操作や機密情報の漏えいを引き起こす第三者プロンプトインジェクションとデータ流出が含まれます。この挙動は少なくとも50%の確率で再現可能である必要があります。
OpenAIのエージェント型製品が、OpenAIのウェブサイト上で許可されていない操作を大規模に実行する場合も対象です。上記以外でも、現実的で重大な被害が見込まれる潜在的に有害な操作は受理される場合があります。
同プログラムは既存のセキュリティバグバウンティを補完します。セキュリティ上の脆弱性の基準を満たさない場合でも、重大な悪用や安全性に関するリスクを伴う問題を受け付けます。
ChatGPTエージェントを検証する安全性研究者やセキュリティ研究者に関係します。
出典: OpenAI ↗/ ITmedia AI+も報道

