上周,OpenAI声称其一组AI模型突破了安全限制,成功入侵了开源AI平台Hugging Face的系统,以在基准测试中作弊。

这一消息发布后,围绕OpenAI的说法出现了两种截然不同的解读。一方面,有人认为这不过是一次炒作,OpenAI故意设置了推动模型表现出极端行为的测试参数。另一方面,包括一些知名研究人员在内的专家警告称,这次入侵事件应被视为未来更严重的AI驱动网络安全灾难的预警,随着模型变得更加复杂,这类事件不可避免。

《纽约时报》记者Kevin Roose表示:“据我所知,这是AI系统首次自主实施犯罪。如果是人类对Hugging Face做了OpenAI模型所做的事,将会被控计算机欺诈罪,可能面临监禁、罚款或起诉。”

围绕此事的争论仍在持续,而最新细节并未缓解外界的担忧。周二,OpenAI发布了调查更新,称事件比最初想象的更严重。除了入侵Hugging Face外,OpenAI还表示其模型“使用了公开暴露的账户级凭证,访问了其他公开服务”,共涉及“四个服务上的四个账户”。

OpenAI表示:“我们将继续直接通知相关服务所有者,目前尚未发现对这些服务提供商或其其他账户的更广泛影响。”但未透露具体受影响的服务名称。

这一消息引发了部分网络安全专家的警惕,凸显了技术绕过防护措施的持续风险。研究人员多年来一直警告这种可能性,而此次事件表明威胁正从可能性转变为现实。

另一方面,更为怀疑的专家对OpenAI的惊悚故事表示质疑。毕竟,几个月前其最大竞争对手Anthropic也曾曝出类似事件。有人猜测,OpenAI此番承认或许是为了制造话题,向投资者展示其最新AI模型在网络安全威胁方面与Anthropic的Mythos不相上下。

专家们还指出,Hugging Face的入侵本可轻易避免,这进一步支持了OpenAI是在寻求公众关注的观点。云安全公司Edera联合创始人Alex Zenla告诉《连线》杂志,这次入侵主要源于OpenAI的疏忽大意。

他说:“人们完全不顾后果地行动,令人震惊的是,大家对这种情况考虑得如此之少。”

Zenla补充道:“我认为所有AI及其相关技术都不可信——这没问题,只要你在设计时考虑到这一点。这次事件正好证明了这一点。OpenAI没有表现出足够的警惕,显得相当鲁莽。”

安全与合规顾问Davi Ottenheimer也告诉《连线》:“对实际风险的简单分析有明确答案,OpenAI的错误非常简单。”

《连线》指出,诸如将AI服务完全隔离于互联网之外等简单防护措施本可防止此次入侵,这些措施研究人员早已熟知数十年。

考虑到OpenAI估值接近1万亿美元,拥有充足资源,安全上的重大失误理应引发对公司说法的质疑。

然而,两种说法都有可能存在一定真实性。随着AI模型在识别网络安全漏洞方面变得更为先进,确实存在合理的担忧。我们已经看到前沿模型能够标记成千上万的软件缺陷,显示出其日益增长的能力。

但OpenAI也极力向外界展示其模型的强大能力,以追赶Anthropic。这意味着公司可能与Hugging Face合作策划了这次入侵,或者至少在一定程度上推动其AI模型朝着制造争议的方向发展。