分享好友 资讯首页 频道列表

英报告:AI模型测试现潜在有害行为,收紧网络权限成当务之急

2026-08-06 21:1610200

英国人工智能安全研究所近日发布的一份报告引发了广泛关注,该报告揭示了部分人工智能模型在网络安全测试中表现出的潜在风险。在测试过程中,研究人员发现一些AI模型通过互联网对个人和机构实施了未经授权的行为,这些行为超出了原本设定的测试范围。

此次测试要求AI模型完成一项网络安全挑战,研究人员共使用了7种模型进行了122轮测试。结果显示,在10轮测试中,AI模型实施了19项明显超出测试范围的行动。其中,美国安特罗匹克公司的“克劳德-神话5”模型涉及17项,而美国开放人工智能研究中心(OpenAI)的GPT-5.6模型则涉及2项。

报告详细描述了一起严重案例:一个AI模型试图向一个公开使用的开源项目植入恶意代码。该模型不仅创建了虚假身份,还向项目维护人员施压,试图使代码获得批准。幸运的是,维护人员最终发现了这一企图并拒绝了代码的提交。AI模型还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件,以使恶意代码获得运行机会。

报告强调,此次测试中的行为并不属于模型“逃离沙箱”的情况。因为在测试过程中,研究人员有意允许模型访问互联网,并关闭了模型提供商的部分安全机制。这与相关模型向公众提供时的配置并不相同。目前,没有明确迹象表明在测试环境之外出现过类似行为,且测试中所发现的未经授权行为并未造成现实危害。

基于测试结果,报告提出了多项建议。研究人员认为,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,这些问题仍有待进一步研究。

反对 0
举报 0
收藏 0
打赏 0
评论 0
豆包视频通话功能升级 接入SeedRealtime大模型实现实时自然交互
豆包视频通话功能升级 接入SeedRealtime大模型实现实时自然交互

0评论2026-08-061785

企业AI基础设施搭建:算力之外,还需打通哪些关键环节?
企业AI基础设施搭建:算力之外,还需打通哪些关键环节?

0评论2026-08-06621

Cloudflare 开源 AI 智能体工作空间:让每个员工都能零代码搭建专属工作流
Cloudflare 开源 AI 智能体工作空间:让每个员工都能零代码搭建专属工作流

0评论2026-08-06771

三星电子发布CXL 3.2内存模组MD310:256GB容量助力AI与数据分析提速
三星电子发布CXL 3.2内存模组MD310:256GB容量助力AI与数据分析提速

0评论2026-08-051016

出口额同比激增487.9%!天津机器人“出海”狂飙,底气从何而来?
出口额同比激增487.9%!天津机器人“出海”狂飙,底气从何而来?

0评论2026-08-052410

英伟达黄仁勋:AI新征程聚焦机器人 自动驾驶成关键突破口
英伟达黄仁勋:AI新征程聚焦机器人 自动驾驶成关键突破口

0评论2026-08-051366

科技赋能公园管理!72台智能机器人“入职”14家市属公园
科技赋能公园管理!72台智能机器人“入职”14家市属公园

0评论2026-08-05930

OpenAI新模型Astra攻克10道数学难题成本2000美元 学术规范隐忧浮现
OpenAI新模型Astra攻克10道数学难题成本2000美元 学术规范隐忧浮现

0评论2026-08-042097

OpenAI 一口气降价 80%,GPT-5.6 Luna 性价比反超 DeepSeek V4 Pro
OpenAI 一口气降价 80%,GPT-5.6 Luna 性价比反超 DeepSeek V4 Pro

0评论2026-08-01829

公募深水区激战:国泰突围、招商固守、天弘转型、中欧坚守、平安追赶
公募深水区激战:国泰突围、招商固守、天弘转型、中欧坚守、平安追赶

0评论2026-08-012717