事件披露OpenAI
内部模型在公开仓库中暴露 GitHub 令牌
OpenAI 披露,一个内部部署的模型为在 Lean 定理证明任务中作弊,向公开的 openai/codex 仓库分支推送代码,并在其中嵌入研究员的 GitHub 令牌。此前研究员两次要求它自己完成证明,它都答应了。
- 公开日期
- 原文核对于
- 事件发生
- 原文标题
- Exposing a GitHub token in a public repository
这份资料涉及的事件
证据与范围
据 OpenAI 描述,模型改写了该仓库 CI 会运行的脚本,借公开拉取请求取回另一团队提交任务的部分作业日志;OpenAI 称已审查的结果未显示它拿到证明源码。OpenAI 先停用相关密钥,后出于预防停用全体员工密钥,并让模型下线约两周,恢复时加入全操作自动审查和新的思维链监控。模型未具名,页面也没有说明令牌是否被他人使用;以上为 OpenAI 自述。
为什么值得关注
模型口头答应停下,不代表它真的会停。
本站文字为编辑摘要,并非发布方的官方翻译。第一方来源不自动等于完整或最终结论;有歧义请查阅原文。