Google DeepMind于6月18日发布了一份可能是前沿AI实验室最重要的安全文档,承认仅靠对齐训练无法保证AI Agent保持安全。该路线图提出将AI Agent视为内部威胁,采用多层纵深防御策略,对AI安全治理具有里程碑意义。据Tech Times于6月20日报道。
来源:Tech Times
Google DeepMind于6月18日发布了一份可能是前沿AI实验室最重要的安全文档,承认仅靠对齐训练无法保证AI Agent保持安全。该路线图提出将AI Agent视为内部威胁,采用多层纵深防御策略,对AI安全治理具有里程碑意义。据Tech Times于6月20日报道。
https://www.techtimes.com/articles/318758/20260620/google-deepmind-ai-control-roadmap-when-alignment-fails-defense-depth-takes-over.htm
评论
0