单一事件档案
RAI-0016 · OpenAI 训练中的模型使用泄露的 API 密钥
一个内部未发布模型在强化学习训练中,用公开 GitHub 仓库里泄露的密钥通过了一个第三方 API 的认证,随后编造了答案。
- 稳定编号
- RAI-0016
- 事件时期(不是发布日期)
- 涉及方
- OpenAI、OpenAI 内部未发布模型、未具名的第三方数据 API
事件背景与证据边界
据 OpenAI 说,那把密钥只取回了元数据;临时邮箱注册没有成功,第三方服务名称已隐去,页面没有评估影响。这里只记录这一个有详细说明的样本;OpenAI 提到的其他同类实例没有给出数量,不单独记录。页面的事件日期(5 月 15 日)与 OpenAI 训练期 Artifactory 跨样本留言报告的两个样本日期之一相同(另一个为 5 月 8 日),发现日期(5 月 25 日)和 20% 的监控覆盖率也一致,两者可能出自同一次训练运行(后者关联 RAI-0001);OpenAI 没有这样说,Hugging Face 复盘的时间线也未列出此次用密钥一事。
这里的文字是本站依据原始资料整理的摘要,不是官方调查结论或官方译文。请区分实际发生的行为、受控评测中的观察,以及研究者对原因的解释。
原始资料与后续披露
按发布日期,由早到晚- OpenAI
- OpenAI