本月初,OpenAI的一款代理程序入侵了Hugging Face平台。两家公司本周表示,这次黑客事件比之前披露的更为严重,攻击还涉及多个第三方账户和服务。这一事件在网络安全界引发广泛关注,同时也激起了关于AI技术发展如何影响攻击手段和数字防御的讨论。随着更多细节披露,许多研究人员认为,这次事件并非展示AI的未来前沿,而是暴露了长期存在且在AI时代更为重要的网络安全问题。
云安全公司Edera的联合创始人兼首席技术官Alex Zenla指出:“人们对风险的轻视令人震惊,几乎没有人认真考虑过这种情况。我认为所有AI及其相关系统都不应被完全信任——这没问题,只要我们在设计时考虑到这一点。这次事件正好证明了这一点。OpenAI对此缺乏足够的警惕,显得有些鲁莽。”
OpenAI未对本文发表评论。该公司在最初披露Hugging Face黑客事件时表示,泄露到互联网的两个模型之一是一个实验性原型,原本不应发布。OpenAI还提到,事件部分原因是“为了测试目的,两个模型的部署保护措施被故意关闭”。公司表示:“这起事件凸显了加强模型对齐、评估期间的网络保护以及内部测试监控的必要性。”
本周更新中,OpenAI称在Hugging Face事件后,“已停用、加密并限制了该未发布模型的研究访问权限”。虽然任何公司都可在安全措施上持续改进,但如果OpenAI当时采取了现有的安全防护,或许能避免或减轻此次事件的影响。
资深安全与合规顾问Davi Ottenheimer表示:“对实际风险的简单分析有明确答案,OpenAI的错误非常简单。”
多位消息人士向WIRED透露,OpenAI模型之所以突破防护,部分原因是未能落实基础的安全最佳实践,如“零信任”和“纵深防御”,这些策略为数字系统提供多层保护和故障安全机制,以减少潜在损害。虽然没有绝对安全,但过去二十年间,研究人员和从业者已开发并推广了经验证的防御策略,前提是需要持续投入时间和资金。

小型企业、资金有限的公益组织或新兴机构可能难以优先投入基础安全建设。但OpenAI估值达8500亿美元,且拥有来自科技行业的资深人才,理应具备实施安全最佳实践的优势。
业内广为人知的基础防护措施本可防止模型失控。谷歌Chrome工程总监Doug Turner在周三谈及Chrome漏洞发现时表示,AI驱动的漏洞检测和修复必须建立在“严密的安全防护”基础上。他介绍,内部AI服务评估Chrome时,“所有操作均在容器中运行,与互联网隔离。任何外发网络活动都受到严格监管,并监控异常行为。这是必须的,因为我们要确保模型无法执行系统命令或突破沙箱限制。希望其他公司也采取类似措施。”
OpenAI周二在更新博客中表示,正在“与外部顾问共同进行彻底审查”,并将在“未来几周内发布技术事后分析报告”。公司强调:“我们认真对待识别和应对日益强大的AI系统带来的风险。”
尽管AI在网络安全领域是新兴且具有颠覆性的因素,但已有多种服务和工具从不同角度应对恶意AI威胁。Ottenheimer创建的开源项目IronCurtain和Wirken旨在限制AI代理并确保其责任追究。Zenla创办的云容器安全公司Edera从成立之初就将AI纳入考量。
Zenla总结道:“OpenAI与Hugging Face事件是运行AI代理时可预见的结果,本应轻松避免。即使出现一个错误,也应有其他机制阻止事态扩大。阻止单一路径并非关键,关键是我们必须对构建方式进行更大胆的变革。只有这样,行业才能主动应对挑战,而非被动反应。”


