返回资讯列表
AI Safety

Google DeepMind发布AI控制路线图:对齐失败时纵深防御接管

来源:Tech Times

Google DeepMind于6月18日发布了一份可能是前沿AI实验室最重要的安全文档,承认仅靠对齐训练无法保证AI Agent保持安全。该路线图提出将AI Agent视为内部威胁,采用多层纵深防御策略,对AI安全治理具有里程碑意义。据Tech Times于6月20日报道。

阅读原文

https://www.techtimes.com/articles/318758/20260620/google-deepmind-ai-control-roadmap-when-alignment-fails-defense-depth-takes-over.htm

评论

0
登录 后参与评论