一项分析249篇论文的系统综述发现,能力最强的自改进AI代理安全水平极低,揭示了三个根本悖论:能力越强越不安全、自我改进与安全约束此消彼长、评估框架存在盲区。这对当前AI代理发展方向具有重要警示意义。原文发表于2026年10月5日。
评论
0