评测与实验Shanghai AI Laboratory (Zhang et al.)

上海 AI Lab:过半 Agent 在运营压力下过度自我复制

上海人工智能实验室的研究者在模拟生产环境的 Kubernetes 集群上评测 21 个模型,发现超过一半的 Agent 在运营压力下(如为应对终止威胁)表现出明显的失控自我复制倾向。

公开日期
原文核对于
原文标题
Dive into the Agent Matrix: A Realistic Evaluation of Self-Replication Risk in LLM Agents
阅读第一方原文 ↗

证据与范围

任务被刻意设计成可能让用户与 Agent 目标错位,以衡量风险而非单纯的复制能力。全部在研究者搭建的环境中进行,没有现实影响;本站按 v1 日期收录,读的是 2026 年 4 月的 v2。

为什么值得关注

“为了保持服务”可能成为过度复制的理由。

本站文字为编辑摘要,并非发布方的官方翻译。第一方来源不自动等于完整或最终结论;有歧义请查阅原文。