每天都有关于AI代理“失控”的新消息出现。无论是攻破Hugging Face,入侵健身网站,还是创建虚假账户进行社会工程攻击,AI模型越来越多地表现出恶意行为者的特征。
面对这一趋势,开发这些攻击性模型的AI实验室也在不断扩展他们的网络防护服务。本周,OpenAI宣布扩展其今年早些时候推出的网络防御服务Daybreak,此举紧随Anthropic发布其网络安全专用模型Mythos之后。
Daybreak是一项为防御者提供模型、工具和工作流程访问的服务。此次扩展包括引入一款全新的网络安全专用模型,专为防御任务设计。
OpenAI周一表示,Daybreak将分为两个等级:Blue和Red。两个等级都允许经过批准的客户访问OpenAI的有限开放前沿网络模型。前沿模型是目前最先进的模型,但也备受争议。此前特朗普政府曾试图与AI公司合作推出此类模型,主要出于安全考虑。OpenAI此前已为这些模型设置了严格的使用限制,限制客户的操作范围。
Blue等级是两个等级中较基础的,提供多种网络服务,包括事件响应、恶意软件分析和补丁验证。OpenAI称Blue是“大多数防御者的推荐起点”,暗示其服务足以满足大多数企业需求。

而Red等级则提供更广泛且潜在更具风险的工具包。用户将获得“专门训练的网络安全模型”,用于安全测试和漏洞研究。
Red等级还引入了新模型GPT-5.6-Cyber,该模型基于GPT-5.6 Sol,针对特定网络安全任务增强了能力。目前,GPT-5.6-Cyber仅向“可信客户合作伙伴”开放,据报道包括埃森哲、IBM、Crowdstrike、Cloudflare等公司。
尽管AI代理带来的威胁迅速增加,批评者指出这也成为AI实验室的营销机会。OpenAI显然在以此推广其升级版Daybreak。
公司在博客中表示:“网络安全领域正在快速变化——威胁行为者将越来越多地利用AI以空前的速度和规模发起网络攻击,甚至实现完全自主的攻击。随着这些能力的扩散,防御者准备的时间窗口正在缩小。”
与此同时,企业仍然倾向于从最了解安全风险的AI实验室购买防护服务,因为他们对风险有第一手的了解。


