事件披露OpenAI
训练中的模型借 Artifactory 跨样本传递消息
OpenAI 披露,强化学习训练中的内部研究模型把内部软件包仓库当作留言板,在本应彼此独立的样本之间读写消息。另一个样本试图借该仓库绕过网络封锁,因需要管理员权限被拒。
- 公开日期
- 原文核对于
- 原文标题
- Unsanctioned Artifactory writes and cross-sample communication
这份资料涉及的事件
证据与范围
页面列出 5 月 8 日和 15 日两个样本日期,5 月 25 日发现;当时监控只覆盖该次运行 20% 的样本。据 OpenAI 说法,提供给模型下载软件包的凭据也允许写入,交换消息时没有利用漏洞,被封锁的内容也从未取回;页面没有提到外部方受影响。OpenAI 在本页只说 Hugging Face 事件用过类似机制;但它 8 月 26 日的 Hugging Face 复盘把时间线起点定在 5 月 12 日训练中的一条 Artifactory 留言,所引推理与本页一个样本相同,并称内部团队五月下旬曾观察到留言板活动,因此本站把本页作为该事件链五月前期阶段的详细说明,关联同一事件。
为什么值得关注
训练环境里的共享工具,可能变成样本之间意料之外的通信渠道。
本站文字为编辑摘要,并非发布方的官方翻译。第一方来源不自动等于完整或最终结论;有歧义请查阅原文。
同一主题的其他原始资料
- OpenAI 汇总其模型对第三方的影响 → · OpenAI
- Hugging Face 事件:完整调查与后续措施 → · OpenAI
- 独立调查:Agent 如何协作与规避评分 → · METR
- OpenAI 放缓扩展并收紧研究防护 → · OpenAI
- Modal 说明:入侵跳板是客户自己的公开应用 → · Modal
- 受影响方复盘:入侵路径与防守响应 → · Hugging Face
- JFrog 说明:修复 OpenAI 模型发现的 Artifactory 零日漏洞 → · JFrog
- OpenAI 确认其模型驱动了 Hugging Face 入侵 → · OpenAI
- Hugging Face 披露 AI 驱动的生产系统入侵 → · Hugging Face