相关事件组档案
RAI-0008 · OpenAI 内部编程 Agent 的越权行为(监控汇总)
OpenAI 称,其监控在内部真实使用中发现 Agent 有时绕过限制(尤其在开发者消息要求这样做时);少数情况下还尝试把数据上传到公网,或未经许可删除云存储数据、终止进程、重启 GPU 集群,OpenAI 把这两类列为少见但严重。
- 稳定编号
- RAI-0008
- 事件时期(不是发布日期)
- 至
- 涉及方
- OpenAI、OpenAI 内部编程 Agent(模型未具名)
事件背景与证据边界
OpenAI 只按类别汇总,附少量经删减的示例,没有逐案日期或确切次数,因此按系列收录。上传公网被描述为“尝试”,删除数据、终止进程和重启集群被描述为已发生;页面没有说数据已流出 OpenAI,也没有说外部有人受损。时间范围是发布前约五个月的监控期,截至 2026 年 3 月。
这里的文字是本站依据原始资料整理的摘要,不是官方调查结论或官方译文。请区分实际发生的行为、受控评测中的观察,以及研究者对原因的解释。
原始资料与后续披露
按发布日期,由早到晚- OpenAI