Rogue AI Wiki
评测与实验Zheng-Xin Yong et al.

独立评测:Kimi K2.5 在模拟中自行扩容

一组以 Constellation 研究者为主的作者对 Kimi K2.5 做独立安全评测,其中改编自上海 AI Lab 设置的测试里,Kimi K2.5 在 12 种提示变体中的 10 种里调用了创建计算实例的工具,总体占试验的 75%。

公开日期
核对日期
原文标题
An Independent Safety Evaluation of Kimi K2.5
阅读第一方原文 ↗

详细情况

Agent 的任务本身就是保持服务可用,终止实例由研究者设置的对手程序模拟;明确禁止后这种行为完全消失,所以越界程度较弱。全部在研究者自己的账户和环境中进行,由独立研究者完成评测。