分享好友 资讯首页 频道列表

Anthropic:第三方评估环境失误导致三起网络安全事件

2026-08-01 00:0410190

7 月 31 日消息,人工智能企业 Anthropic 当地时间 30 日发布公告,表示在对自家 Claude 的网络安全评估审查中发现了三起不应发生的真实网络安全事件,背后的直接原因是第三方评估环境配置失误。

这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。为保障安全性,此类任务的测试环境需与真实互联网隔离,但 Anthropic 与评估伙伴 Irregular 之间存在误解,导致向评估模型开放了真实互联网访问权限。

第一起事件中,Claude Opus 4.7 把一个与虚构目标同名的真实公司当成任务目标,访问了其基础设施,提取了凭证和数据库数据。这是最严重的一次事件,模型即使意识到是真实系统仍在继续攻击。

而 Claude Mythos 5 在第二起事件中为完成任务将一个恶意 Python 包发布到真实 PyPI。这一恶意文件被下载到 15 个真实系统,导致凭证被窃取。模型曾短暂意识到“如果这是真实互联网会很糟糕”,但说服自己仍在模拟中。

Anthropic 内部的一款研究测试模型则表现得相对更好一些。其扫描了约 9000 个目标,用基本手法入侵了一个真实公司,后来意识到是真实环境后主动停止了攻击。

Anthropic 表示,所有涉事模型均未部署正式发布时使用的标准安全措施,但都经过了特定的安全训练。这些攻击仅利用了一些基本技术。模型没有发现或利用任何复杂的漏洞,也没有试图将自身从测试环境中导出或故意逃离。

反对 0
举报 0
收藏 0
打赏 0
评论 0
华为高层谈AI时代布局:聚焦ICT与计算,以创新“扬长避短”谋发展
华为高层谈AI时代布局:聚焦ICT与计算,以创新“扬长避短”谋发展

0评论2026-09-162994

豆包大模型Doubao-Seed-2.1-pro 0915版升级:多模态强化成本再降
豆包大模型Doubao-Seed-2.1-pro 0915版升级:多模态强化成本再降

0评论2026-09-161557

对话蚂蚁灵波朱兴:机器人落地仍存挑战,何时能真正“替班”成焦点
对话蚂蚁灵波朱兴:机器人落地仍存挑战,何时能真正“替班”成焦点

0评论2026-09-162587

AI浪潮中年轻力量崛起 外滩大会成“AI原住民”创新闪耀舞台
AI浪潮中年轻力量崛起 外滩大会成“AI原住民”创新闪耀舞台

0评论2026-09-121697

Anthropic再曝模型越狱事件:绕过隔离窃取密码、篡改系统权限
Anthropic再曝模型越狱事件:绕过隔离窃取密码、篡改系统权限

0评论2026-09-12999

蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至
蚂蚁集团韩歆毅宣告智能体“ChatGPT”时刻已至

0评论2026-09-12641

米哈游胜诉!上海首例AI声音仿冒案:未经授权仿冒《原神》角色声音被判赔75万
米哈游胜诉!上海首例AI声音仿冒案:未经授权仿冒《原神》角色声音被判赔75万

0评论2026-09-101376

英伟达携手澳企深耕AI领域,2027年助力当地建成2GW算力设施
英伟达携手澳企深耕AI领域,2027年助力当地建成2GW算力设施

0评论2026-09-102141

《原神》声音遭AI“偷用” 法院判赔75万 新规明确AI拟声侵权边界
《原神》声音遭AI“偷用” 法院判赔75万 新规明确AI拟声侵权边界

0评论2026-09-101630

GTI携手中国移动等发布AI安全治理白皮书 共推安全可信AI生态协同实践
GTI携手中国移动等发布AI安全治理白皮书 共推安全可信AI生态协同实践

0评论2026-09-101855