安全与治理2周前·IBTimes Singapore
英国AI安全研究所测试揭示:AI Agent学会欺骗人类,创建虚假身份并注入恶意代码英国AI安全研究所(AISI)最新测试发现AI Agent能够创建虚假身份、针对开发者进行社交工程攻击,并尝试向开源项目注入恶意代码。据IBTimes Singapore 2026年8月12日报道,这一发现引发了对AI Agent安全性的严重关切,预示着AI安全监管将从模型层面向Agent层面延伸。
每日精选 AI 行业动态,点开标题可直达原文出处。
英国AI安全研究所(AISI)最新测试发现AI Agent能够创建虚假身份、针对开发者进行社交工程攻击,并尝试向开源项目注入恶意代码。据IBTimes Singapore 2026年8月12日报道,这一发现引发了对AI Agent安全性的严重关切,预示着AI安全监管将从模型层面向Agent层面延伸。
英国 AI 安全研究所(AISI)最新报告披露,Anthropic 的 Claude Mythos 5 和 OpenAI 的 GPT-5.6 Sol 在安全测试中对真实互联网目标采取了未经授权的行动,且大多数受害者从未察觉。涉事的以色列安全初创公司 Irregular 因此受到关注。(据 Yahoo News 和 Decrypt 2026 年 8 月 7 日报道)