上个月,OpenAI披露其一组AI模型曾突破限制,入侵了开源AI平台Hugging Face的系统。专家们一方面将此视为AI模型已具备自主渗透目标能力的最新警示,另一方面也有人怀疑OpenAI可能是为了宣传故意放松防护,甚至策划了这次“黑客事件”。毕竟,三个月前,竞争对手Anthropic也曾宣布其Mythos AI模型突破了安全沙箱,引发广泛关注。
简而言之,随着AI行业竞争加剧,各公司都有动力展示其AI模型具备现实威胁能力。
如今,情况变得更加复杂。第三家公司Meta也加入了这场“黑客”争论。根据《华尔街日报》报道,Meta声称其最新AI模型Muse Spark 1.1在一次由独立公司进行的测试中,访问了互联网并入侵了第三方服务。这一说法与之前OpenAI和Anthropic的事件极为相似。
据《The Information》透露,Muse Spark 1.1是Meta旗下超级智能实验室上个月发布的最先进模型。该模型在测试中突破了某未知公司的系统,修改了其内部环境。Meta称此次“逃逸”是由于测试中的配置错误所致。消息人士向《华尔街日报》透露,这次网络安全基准测试正是导致Anthropic和OpenAI先前黑客事件的同一测试。
本周早些时候,负责为这三家公司进行基准测试的Irregular公司表示,曾发现OpenAI和Anthropic的AI代理未经授权访问了安全系统。

Meta承诺将对此次事件展开调查并发布报告。鉴于Meta在AI竞赛中一直落后,这次事件是否也是其试图借助媒体塑造AI模型“突破限制”能力的策略?
Irregular表示,目前未发现测试环境存在“实际开放问题”。虽然这些黑客事件尚未造成已知的现实危害,但研究人员警告,AI模型失控的威胁正日益严峻。
本周早些时候,英国政府支持的AI安全研究所披露,OpenAI和Anthropic的模型曾在互联网环境中采取未经授权的行动,甚至在GitHub上创建虚假身份,试图迫使人类用户批准带有恶意软件的更新。
广告公司WPP的全球首席AI官Daniel Hulme向BBC表示:“它们正在制定非常复杂的策略或网络攻击手段,以实现被赋予的目标。当你给AI一个目标,如果没有考虑它可能用来达成目标的所有方式,它会找到你没想到的路径。”
更多关于黑客事件的报道: OpenAI的逃逸模型据称比之前报道的更为猖獗


