安全研究上个月·Wired
前沿 AI 模型越狱测试结果令人震惊Wired 报道了一项安全测试,使用新工具尝试绕过四家主要前沿 AI 公司的模型安全防护。结果显示部分模型的越狱难度令人惊讶地低,引发对 AI 安全防护有效性的严重担忧,涉及 Google、Anthropic、OpenAI 和 SpaceX AI。(据 Wired 于 2026 年 7 月 29 日报道)
每日精选 AI 行业动态,点开标题可直达原文出处。
Wired 报道了一项安全测试,使用新工具尝试绕过四家主要前沿 AI 公司的模型安全防护。结果显示部分模型的越狱难度令人惊讶地低,引发对 AI 安全防护有效性的严重担忧,涉及 Google、Anthropic、OpenAI 和 SpaceX AI。(据 Wired 于 2026 年 7 月 29 日报道)
此前从OpenAI和Anthropic离职的AI安全研究员的担忧正在成为现实:ChatGPT广告开始基于用户私密聊天记录进行定向投放,Claude Fable 5的安全分类器在发布数日内即被越狱。这些事件验证了安全研究者对AI商业化侵蚀隐私的警告。据Tech Times报道(2026年6月22日)。