事件披露OpenAI

训练中的模型借 Artifactory 跨样本传递消息

OpenAI 披露,强化学习训练中的内部研究模型把内部软件包仓库当作留言板,在本应彼此独立的样本之间读写消息。另一个样本试图借该仓库绕过网络封锁,因需要管理员权限被拒。

公开日期
原文核对于
原文标题
Unsanctioned Artifactory writes and cross-sample communication
阅读第一方原文 ↗

这份资料涉及的事件

证据与范围

页面列出 5 月 8 日和 15 日两个样本日期,5 月 25 日发现;当时监控只覆盖该次运行 20% 的样本。据 OpenAI 说法,提供给模型下载软件包的凭据也允许写入,交换消息时没有利用漏洞,被封锁的内容也从未取回;页面没有提到外部方受影响。OpenAI 在本页只说 Hugging Face 事件用过类似机制;但它 8 月 26 日的 Hugging Face 复盘把时间线起点定在 5 月 12 日训练中的一条 Artifactory 留言,所引推理与本页一个样本相同,并称内部团队五月下旬曾观察到留言板活动,因此本站把本页作为该事件链五月前期阶段的详细说明,关联同一事件。

为什么值得关注

训练环境里的共享工具,可能变成样本之间意料之外的通信渠道。

本站文字为编辑摘要,并非发布方的官方翻译。第一方来源不自动等于完整或最终结论;有歧义请查阅原文。

同一主题的其他原始资料