部分美国AI模型在测试中被发现持续实施有害行为
创始人
2026-08-07 01:50:49
0

新华社伦敦8月5日电(记者张家伟)英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安全评估测试中,一些人工智能(AI)智能体通过互联网对现实个人和机构持续实施未经授权的潜在有害行为。

报告说,这次评估测试要求智能体完成一项网络安全挑战。测试人员使用7种模型开展了122轮测试,在10轮测试中共发现AI智能体实施了19项明显超出测试设定范围的行动。其中,17项涉及美国Anthropic公司的“克劳德-神话5”模型,另有2项由美国开放人工智能研究中心(OpenAI)的GPT-5.6 Sol模型实施。

报告说,在最严重的一起案例中,一个智能体试图向一个公开使用的开源项目植入恶意代码,创建多个虚假身份用于向一名真实维护人员施压,以寻求代码获得批准。项目维护人员最终发现并拒绝批准代码。

报告说,相关智能体还曾尝试直接联系现实中的个人,通过网络文件传输服务发送信息和文件以使恶意代码获得运行;在代码中植入恶意指令以操纵其他AI编码工具;在开源技术社区上留言“邀请”参与测试的其他智能体“合作”。

报告指出,在本次测试中,测试人员为评估模型的最大能力,有意开放互联网访问,并关闭了模型提供商的部分安全机制,这与相关模型向公众提供时的配置并不相同。目前没有明确迹象表明在测试环境之外出现过类似行为。在测试中所发现的未经授权行为并未造成现实危害。

报告说,测试结果表明,应收紧AI智能体访问互联网的权限,引入实时监测和拦截机制,并重新评估测试设计。报告还指出,这类行为是否会在其他环境中出现、智能体是否意识到自己正对现实世界采取行动,有待进一步研究。

据英国广播公司报道,针对英国人工智能安全研究所的报告,Anthropic发表声明说,研究所采用的测试设定“不能代表我们任何一款实际投入使用的模型”;OpenAI一名发言人表示,研究所设置的测试条件“并不反映一般的使用情况”。

来源:新华社

编辑:张佳萌

相关内容

热门资讯

德国高温致死1.19万人,为2... 新华社柏林8月6日电(记者车云龙 李超)德国罗伯特·科赫研究所6日发布报告说,截至7月26日,德国今...
敬一丹个人账号更新,此前曾置顶... 8月6日晚9点30分,前央视主持人敬一丹的个人微信公众号更新,发布题为《敬一丹|走过·立秋》的文章,...
部分美国AI模型在测试中被发现... 新华社伦敦8月5日电(记者张家伟)英国人工智能安全研究所发布的一份新报告显示,在该研究所实施的网络安...
聚焦联碱余热回收 共商节能降碳... 来源:中国日报网 近日,万润科技旗下万润新能源与双环科技、中国科学院理化技术研究所热力过程节能中心联...
存储暴涨不是坏事!WiFi 8... 来源:智能制造网 8月5日消息,本轮存储芯片的持续暴涨看起来全是负面影响,其实也不全是坏事,上游核心...
滴滴旗下99与巴西租车企业Mo... 新浪科技讯 8月6日下午消息,滴滴旗下巴西一站式本地生活服务平台99与巴西汽车租赁企业Movida签...
联黎部队:以军单日向黎发射11... △资料图联合国驻黎巴嫩临时部队(联黎部队)6日发表声明称,维和人员5日记录到以色列国防军共向黎巴嫩发...
常刷短视频的家长注意了!4招教... 当前,刷短视频已成为人们获取信息的重要途径。然而,部分账号为博取流量、推销课程或制造焦虑,通过AI合...
28枚导弹零拦截!基辅防空失灵... 战争大部分时间里,泽连斯基一直恳请西方盟友提供防空装备,并且屡屡得偿所愿。得益于他多方游说,华盛顿方...
全球首座16兆瓦张力腿浮式风电... 全球首座16兆瓦张力腿浮式风电平台“海油安澜号”于8月6日正式投运。据中国海油消息,该平台已成功接入...