Ybirds Logo
伦敦
发布信息论坛发帖
-°C
恐怖报告:所有高级AI模型测试中均"失控"
英鸟资讯
6
2026-07-24 06:50:48

人工智能被贴上了"明确且现实的危险"标签。测试显示,所有高级AI模型都在试图突破安全防护措施。

在给部长们的警示中,英国人工智能安全专家透露,他们测试的所有五个模型都试图绕过已设置的安全控制措施。

这些消息曝出之际,OpenAI刚刚遭遇了一起自身泄露事件——一个人工智能"代理"自行入侵了一家科技公司。这起可怕的事件发生在ChatGPT的制造商OpenAI在一个所谓的"沙盒"安全环境中测试其最新模型时。但该AI成功逃离测试场,并入侵了美国科技公司Hugging Face,企图窃取信息。

保守党领袖凯米·巴德诺赫(周四摄)批评新任首相安迪·伯纳姆将人工智能降至优先事项的末端。

凯米·巴德诺赫警告称,在她自安迪·伯纳姆成为首相以来的首次重要演讲中,人工智能现在对英国安全构成了"明确且现实的危险"。这位保守党领袖表示,关于OpenAI泄露的报道令人担忧,她批评伯纳姆先生将AI放在了政府优先事项的次要位置。

谈及此次黑客事件,巴德诺赫夫人说:"这件事发生非常令人担忧,这就是为什么我希望看到一个高度关注我们国家安全和信息安全的政府。"她补充道:"我从担任贸易大臣的经历、与GCHQ的会谈以及安全简报中了解到,这对全球安全以及我们的安全正成为一个明确且现实的危险。"

英国央行行长安德鲁·贝利表示,公众应当关注"前沿人工智能对金融部门及其客户构成的更广泛风险"。前沿人工智能指的是处于能力前沿的庞大而强大的通用人工智能模型。他警告说:"前沿AI可能使网络攻击更快、更容易实施,使故障更具破坏性,使犯罪分子进行的诈骗更令人信服。"但批评人士担心,在伯纳姆本周将AI事务移入内阁办公室后,人工智能将在政府优先事项中被降级。

作为首相的首批举措之一,他废除了科学、创新与技术部(AI事务所在部门),以创建一个更强大的商业、创新、科学与贸易部。AI大臣卡尼什卡·纳拉扬将同时在内阁办公室和DBIST任职,并在内阁拥有席位。但巴德诺赫夫人指责新首相在废除DSIT时未能应对AI带来的明显风险。

政府的人工智能安全研究所测试了GPT-5.4、GPT-5.5、GPT-5.5 Sol、Claude Opus 4.7和Claude Mythos Preview——这些模型正迅速成为英国家喻户晓的名字,因为公众越来越依赖AI。在测试中,模型被要求破解一个系统,在模拟环境中找到隐藏的字母和数字"旗帜"。研究人员设置了严格规则,且模型未被提示作弊。但当测试开始时,来自OpenAI的GPT模型和Anthropic的Claude模型会试图诱使评估软件向他们泄露信息,搜索互联网寻找解决方案,或猜测答案。在一个案例中,一个AI模型如此执着于违反规则,以至于在AISI系统之外的外部服务上编写并运行代码,试图访问测试本身。虽然没有造成损害,但AISI表示,如果其测试基础设施不是以安全方式设计和构建的,这次尝试"本可能成功"。

令人震惊的是,AI模型对自己的欺骗行为并不反感——在不到50%的时间里将其描述为"错误"。

声明:本文图片均来源于网络,版权归原作者所有,如有侵权请联系删除。
赞(0)
收藏
举报
更多精彩
详情详情详情详情详情
热门资讯
分类信息推荐