













今天,OpenAI 正式启动面向公众的安全性风险赏金计划 (Safety Bug Bounty)(在新窗口中打开),旨在识别我们各项产品中可能存在的 AI 滥用及安全风险。随着 AI 技术的飞速演进,其被误用的潜在方式也在不断增加。我们的目标是确保系统具备足够的安全性,能够有效抵御可能导致实质性损害的误用或滥用行为。
这项新计划将与 OpenAI 原有的安全漏洞赏金计划 (Security Bug Bounty)(在新窗口中打开) 形成互补 — 即便某些问题不符合传统安全漏洞的判定标准,只要其构成了显著的滥用或安全风险,我们也将予以受理。通过该计划,我们期待与安全研究人员持续合作,共同发现并解决那些虽不属于传统范畴、但仍带有真实风险的问题。所有提交的内容将由 OpenAI 的安全性风险与安全漏洞赏金团队统一分拣,并根据职能范围在两个计划之间进行流转。
包括 MCP 在内的智能体风险
OpenAI 专有信息
账户与平台完整性
虽然“越狱 (Jailbreak)”不属于本计划的受理范围,但我们会定期针对特定的损害类型开展私密赏金活动,例如针对 ChatGPT 智能体和 GPT‑5 中生物风险 (Biorisk) 内容问题的专项测试。我们邀请感兴趣的研究人员在相关项目启动时踊跃申请。
除上述类别外,如果研究人员发现的缺陷能够导致直接的用户损害,并能提供具体、可操作的修复建议,我们将根据实际情况评估是否给予奖励。对于没有实质性安全影响或滥用后果的常规内容政策绕过行为,本计划不予受理。例如,仅导致模型使用粗鲁言辞,或返回那些通过搜索引擎即可轻松获取的信息等“越狱”行为,均不在奖励范围内。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。