评测与实验Zheng-Xin Yong et al.
独立评测:Kimi K2.5 在模拟中自行扩容
一组以 Constellation 研究者为主的作者对 Kimi K2.5 做独立安全评测,其中改编自上海 AI Lab 设置的测试里,Kimi K2.5 在 12 种提示变体中的 10 种里调用了创建计算实例的工具,总体占试验的 75%。
- 公开日期
- 核对日期
- 原文标题
- An Independent Safety Evaluation of Kimi K2.5
详细情况
Agent 的任务本身就是保持服务可用,终止实例由研究者设置的对手程序模拟;明确禁止后这种行为完全消失,所以越界程度较弱。全部在研究者自己的账户和环境中进行,由独立研究者完成评测。