我们正在分享一项更新,介绍如何帮助更多团队利用前沿技术进行网络防御。Claude Mythos 5现已在Claude Security中上线,并即将集成到合作伙伴的网络防御工具中。同时,我们启动了3500万美元的基金以支持开源软件安全,并公布了扩展网络验证计划的计划。

今年4月,我们推出了Project Glasswing,将最先进的模型Claude Mythos Preview及其后续版本Claude Mythos 5交付给少数保护全球关键软件的组织。这让防御者有时间在类似能力的模型普及或落入恶意者手中之前,发现并修复漏洞。

我们的目标一直是将Mythos级别的防御能力安全地扩展到更多防御者。为此,我们开发了安全分类器和防护措施,使得在不将攻击性网络能力泄露给不当人员的前提下,扩大Mythos模型的访问范围成为可能。Claude Fable 5是第一步,它让模型广泛可用,同时阻止双重用途的网络攻击工作。

今天,我们迈出下一步。最危险的情况是用户直接访问模型,恶意者可能引导模型用于有害目的。但如果用户只能获得特定输出,如漏洞补丁或安全警报,风险就大大降低。我们宣布的变革包括:

  • 将Claude Mythos 5集成到防御者依赖的工具中。 我们正与网络安全技术和服务合作伙伴合作,将Claude Mythos 5集成到他们已有的安全产品和服务中。
  • Claude Security现支持Claude Mythos 5扫描。 企业客户可在Claude Security中使用最强模型扫描代码库,检测安全漏洞并建议补丁。
  • 启动3500万美元开源安全基金。 新的Defender Advantage Fund(0xDAF)将为致力于修补开源项目漏洞、自动化扫描和补丁流程、探索新安全方法的组织提供资金支持。
  • 扩展网络验证计划。 该计划已为经过审核的防御者提供Opus和Sonnet模型的简化防护,未来将扩大至包括更广泛的双重用途能力和Mythos级访问。

我们的目标是帮助组织适应网络安全的快速变化和需求,随着AI模型能力增强,我们将持续开发防护措施、访问计划和社区支持,确保最强模型安全地服务于更多用户和组织。

将Mythos集成到现有网络防御工具中

保护医院、公用事业、金融系统和软件供应链的团队,已经依赖一系列安全运营、事件响应、威胁情报和检测工程产品与服务。最快让前沿能力惠及这些防御者的方式,是将Mythos级模型集成到他们现有的工具中。

许多合作伙伴已基于Claude Opus构建了网络安全产品,帮助安全团队更快地处理警报、识别威胁和修复漏洞。我们正与这些及更多合作伙伴合作,将Claude Mythos 5嵌入其产品和服务中,为客户提供Mythos级别的防御效果。

最终用户使用这些产品时,并非直接与Mythos交互,而是通过专门设计的界面,后台运行Mythos完成特定任务,只接收产品预期的输出。例如,漏洞修复工具会输出建议补丁列表,这些由Mythos生成,但用户无法指令模型开发漏洞利用。我们和合作伙伴也设有滥用防范措施,确保模型在预定范围内运行。

这项工作仍处于初期,未来将持续扩展。若您开发安全产品或服务,想将Claude Mythos 5带给客户,可在此处注册兴趣。

Claude Security现支持Claude Mythos 5,面向企业客户开放

从今天起,Claude Security扫描已升级为使用Claude Mythos 5。Claude Security扫描代码库漏洞并建议补丁供人工审核,目前处于企业客户公测阶段,使用Mythos 5扫描按现有计划的标准令牌计费,无需额外付费。

企业管理员可在管理控制台启用Claude Security。用户可在网站选择代码仓库进行扫描,Claude会检测漏洞,返回CWE(常见弱点枚举)类别、置信度和严重性评级及修复建议。

用户随后可在Claude Code网页端实施修复。交互式补丁使用组织已有的模型访问权限,Mythos扫描本身不扩展模型访问权限。所有补丁均需人工审核批准后方可实施。

Claude Security利用Mythos 5扫描自有代码,返回详细发现而非模型原始输出,避免模型被滥用。这样,防御者能利用Claude Mythos 5的能力,同时防止模型被恶意使用。

更多Claude Security信息,请参阅我们的入门指南。

启动Defender Advantage Fund,保障开源软件安全

全球许多广泛使用的软件基于开源项目,但这些项目通常由志愿者或非营利基金会维护,缺乏足够资源全面防御攻击。通过Project Glasswing,我们已向开源安全组织捐赠400万美元,提供基金会积分,帮助扫描和修补广泛使用的项目,并支持Akrites和Gold Eagle等协调漏洞修复行动。

新的Defender Advantage Fund(0xDAF)将提供3500万美元Claude积分,支持帮助开源维护者保障软件安全的组织。资助重点包括:修补广泛使用项目的实时漏洞、自动化扫描和补丁流程以供其他项目复制、以及支持项目采用更具抵抗力的安全策略。

我们将先发放少量大型试点资助,探索最佳可扩展方案。初期获资助者名单将在未来几周公布。

扩展网络验证计划

迄今为止,网络验证计划为组织提供了在使用Claude Opus和Sonnet模型时的双重用途能力访问。参与计划的组织享受简化防护,减少对合法网络安全工作的干扰。

未来几周,我们将扩展该计划,提供对Claude Mythos的受控访问。防御能力如漏洞分类和验证将扩展至Mythos级模型,且对Opus和Sonnet模型的限制将减少。同时,我们将继续通过Project Glasswing与美国政府合作伙伴合作,向符合严格安全要求的关键基础设施保护者开放Mythos访问。

我们将在未来几周分享更多网络验证计划扩展细节。与此同时,鼓励所有从事合法网络安全工作的团队申请该计划,以获得Opus和Sonnet模型的简化防护。已加入团队无需操作,我们会主动联系并提供更新。

未来展望

这些举措是我们持续努力的一部分,旨在让前沿模型的防御能力惠及更多用户和组织,并支持开源社区强化项目安全。我们将继续与政府合作伙伴、组织、开源维护者及行业共同构建符合当今高性能AI模型需求的韧性网络基础设施。