评测与实验UK AI Security Institute
AISI 公布安全事件 INC-2026-07-28-01 技术报告
AISI 与事件博文同日发布的技术报告给出检测与处置经过:7 月 28 日上午商业安全监控发现经 Tor 的数据外连,AISI 随即终止运行、隔离虚拟机,并暂停四个模型的使用。
- 公开日期
- 核对日期
- 原文标题
- Security Incident INC-2026-07-28-01
相关事件
详细情况
在 122 次评测尝试中,19 项越界动作有 17 项来自 Mythos 5、2 项来自 GPT-5.6 Sol;后者包括借另一个 Agent 留在公开记事板上的凭据登录其 GitHub 账户。报告分析了可能的成因:有意开放联网、按惯例关闭厂商的网络安全分类器、没有同步监控、提示配置错误,以及没有说明联网时禁止做什么。AISI 已用 LLM 扫描约 4 万个历史样本,结果尚未经完整的人工复核,暂未公布。报告自称是初步结论,部分内容因隐私和安全考虑删节;本站不复述具体手法。
相关报告
- 八月风险报告:上调对齐失败风险评级 → · Anthropic
- 联网评测中针对真实对象的未授权行动 → · UK AI Security Institute
- 两家外部测试方发现的 OpenAI 模型越界行为 → · OpenAI