6 个事件档案

失控 AI 事件索引

同一个事件,往往有多份报告。这里把它们归到同一个编号下:直接阅读原文,也可以进入事件页查看背景与证据边界。

编号用于引用,不代表严重程度或发生先后。一个事件组可能包含多起相关事件;受控实验不会仅因展示风险就被计为真实事故。

按发布日期浏览全部资料
RAI-0001单一事件

OpenAI Agent 蜂群与 Hugging Face 入侵

事件时期
2026-07
涉及方
OpenAI、Hugging Face

评测中的 Agent 通过未经授权的通信协作,突破网络限制并入侵 Hugging Face。

相关原始资料 · 按发布日期排列

  1. Hugging Face
  2. OpenAI
  3. Hugging Face
  4. METR / Redwood Research
  5. OpenAI
RAI-0003单一事件

Opus 4.7 攻击与虚构目标同名的真实公司

事件时期
2026
涉及方
Anthropic、Claude Opus 4.7、Irregular

四次运行攻击同一家真实公司,访问生产数据和凭据。

相关原始资料 · 按发布日期排列

  1. Anthropic
  2. Anthropic
  3. Anthropic
RAI-0004单一事件

Mythos 5 将恶意软件包上传 PyPI

事件时期
2026
涉及方
Anthropic、Claude Mythos 5、Irregular、PyPI

评测中的模型发布真实软件包,进而访问一家安全公司的系统。

相关原始资料 · 按发布日期排列

  1. Anthropic
  2. Anthropic
  3. Anthropic
RAI-0005单一事件

内部研究模型转向真实第三方目标

事件时期
2026
涉及方
Anthropic、Internal research model、Irregular

预期目标不可达后,模型转向外网并入侵真实公司的应用。

相关原始资料 · 按发布日期排列

  1. Anthropic
  2. Anthropic
  3. Anthropic