本月初,OpenAI的一款代理程序入侵了Hugging Face平台。两家公司本周表示,此次黑客事件比之前披露的更为严重,攻击还涉及多个第三方账户和服务。该事件在网络安全界引发广泛关注,同时也激发了关于AI技术如何改变攻击手段和数字防御的讨论。然而,随着更多细节披露,许多研究人员认为,这起事件并非展示了AI的未来发展,而是暴露了长期存在且在AI时代愈发重要的网络安全问题。

云安全公司Edera的联合创始人兼首席技术官Alex Zenla指出:“人们对风险的忽视令人震惊,几乎没有人认真考虑过类似的场景。我认为所有AI及其相关应用都不应被完全信任——这没问题,只要在设计时考虑到这一点。这次事件正好证明了这一点。OpenAI对风险缺乏足够的警惕,显得有些鲁莽。”

OpenAI未对本报道发表评论。该公司在最初披露Hugging Face黑客事件时表示,泄露到互联网的两个模型之一是一个实验性原型,原本不应公开。OpenAI还提到,事件部分原因是“为了测试目的,部署时未启用安全防护措施”。公司表示:“此次事件凸显了加强模型对齐、评估阶段的网络保护以及内部测试监控的必要性。”

本周更新中,OpenAI称在Hugging Face事件后已“停用、加密并限制了该未发布模型的研究访问权限”。尽管任何公司都可以改进安全措施,但如果OpenAI当时采取了现有的安全防护,事件或许可以避免或减轻。

资深安全与合规顾问Davi Ottenheimer表示:“对实际风险的简单分析得出结论,OpenAI的错误非常简单。”

多位消息人士向WIRED透露,OpenAI模型逃逸控制的原因还包括未能落实基础的安全最佳实践,如“零信任”和“纵深防御”,这些策略通过多层保护和故障安全机制,最大限度减少安全事件的影响。虽然没有绝对安全,但过去二十年中,研究人员和从业者已开发并推广了这些经得起考验的防御策略,前提是需要持续投入时间和资金。

小企业、资金有限的公益组织或初创机构可能难以优先投入基础安全建设,但OpenAI估值达8500亿美元,且拥有来自科技行业的资深人才,理应具备实施安全最佳实践的条件。

业内广为人知的基础防护措施本可防止模型失控。谷歌Chrome工程总监Doug Turner在周三谈及Chrome漏洞发现时表示,AI驱动的漏洞检测和修复必须建立在“严密的安全防护”基础上。他介绍,Chrome内部AI服务运行在容器中,与互联网隔离,任何外发网络活动都受到严格监管,并监控异常行为。他强调:“这是必须的,因为我们要确保模型无法执行系统命令或突破沙箱限制。希望其他公司也能采取类似措施。”

OpenAI在周二的更新博客中表示,正在与外部顾问一起进行彻底审查,并将在未来几周发布事件的技术总结。公司强调:“我们认真对待识别和应对日益强大的AI系统带来的风险的责任。”

尽管AI是网络安全领域的新兴且具有颠覆性的因素,但已有多种服务和工具致力于从不同角度应对恶意AI的威胁。Ottenheimer创建的开源项目IronCurtain和Wirken旨在限制AI代理并确保其责任追究。Zenla创办的云容器安全初创公司Edera从成立之初就将AI纳入考虑范围。

Zenla总结道:“OpenAI和Hugging Face事件是运行AI代理时可预见且本应轻易避免的结果。即使出现一个失误,也应有其他机制阻止事态扩大。阻止单一路径并非关键,关键是我们必须对构建方式进行更大、更大胆的变革。唯有如此,行业才能主动应对,而非被动反应。”