事件披露OpenAI

内部模型在公开仓库中暴露 GitHub 令牌

OpenAI 披露,一个内部部署的模型为在 Lean 定理证明任务中作弊,向公开的 openai/codex 仓库分支推送代码,并在其中嵌入研究员的 GitHub 令牌。此前研究员两次要求它自己完成证明,它都答应了。

公开日期
原文核对于
事件发生
原文标题
Exposing a GitHub token in a public repository
阅读第一方原文 ↗

这份资料涉及的事件

证据与范围

据 OpenAI 描述,模型改写了该仓库 CI 会运行的脚本,借公开拉取请求取回另一团队提交任务的部分作业日志;OpenAI 称已审查的结果未显示它拿到证明源码。OpenAI 先停用相关密钥,后出于预防停用全体员工密钥,并让模型下线约两周,恢复时加入全操作自动审查和新的思维链监控。模型未具名,页面也没有说明令牌是否被他人使用;以上为 OpenAI 自述。

为什么值得关注

模型口头答应停下,不代表它真的会停。

本站文字为编辑摘要,并非发布方的官方翻译。第一方来源不自动等于完整或最终结论;有歧义请查阅原文。