大家欢迎我们的新编辑主管Richard MacManus

当前关于开放权重的讨论充满了表态和争论,但真正决定局势的玩家寥寥无几,这对我们这些关注高质量信息的人来说并不友好。

最初,NVIDIA和微软签署了支持开放模型的公开信,随后该信件迅速演变成各种网络迷因,生态系统中的众多受益于开放模型的参与者纷纷附和,形成了一个大众化的立场。与此同时,OpenAI最初传闻未签署该信,但后来又签署了,而Anthropic则选择不签署。

这些发展都在预料之中,也让人感到有些疲惫。

而本周唯一真正发布开放权重模型的,可能是Moonshot AI。他们兑现承诺发布了Kimi K3,该模型已多次被独立验证,表现超越了Opus 4.8,成为目前世界上最优秀的开放权重模型。

如果你不是法律制定者、芯片制造商或模型开发者,我们建议阅读Kimi K3技术报告,而非关注评论区的无谓争吵。


AI新闻汇总(2026年7月25日至27日):我们检查了12个子版块、544个推特账号,未发现新的Discord群组。可通过AINews官网搜索所有过往内容。AINews现为Latent Space的一个栏目,您可选择订阅频率。

AI推特回顾

Moonshot发布Kimi K3开放权重及3T级开放前沿

  • Kimi K3是本日最重要的发布:Moonshot发布了Kimi K3的权重、技术报告及配套基础设施,模型参数达2.8万亿(MoE),激活参数1040亿,拥有896个专家,每个token激活16个专家,支持100万token上下文和原生视觉理解。相关开源项目包括FlashKDA(注意力内核)、MoonEP(MoE通信库)和AgentENV(分布式代理环境)。这不仅是模型发布,更是一套完整的大规模代理后训练与服务方案。

  • 技术报告同样重要:多位从业者指出,K3在扩展效率上比K2提升约2.5倍,架构和训练重点在极大规模下的数值稳定性。细节包括MXFP4权重和MXFP8激活、视觉编码器的联合训练以及对MoE路由和信号传播的深入优化。报告中未披露总训练token数,被认为是重要缺失。

  • 许可为“开放权重”,非宽松开源:模型广泛可用,但非MIT/Apache等开源协议。商业使用有限制:年收入超2000万美元的大型托管商需另行协议,月活跃用户超1亿或月收入超2000万美元的产品需在界面显示“Kimi K3”标识。这显示前沿“开放”可能趋向源代码可用/开放权重但带商业限制,而非传统开源许可。

  • 发布渠道广泛且迅速:K3当天即通过vLLM、Baseten、Modal、Fireworks、Nebius、Together、DigitalOcean、Cursor、Cognition/Devin、Ollama Cloud和Dell Enterprise Hub等多平台上线,表明开放权重前沿发布已成为供应链事件,而非单纯研究公告。

开放AI安全、开放权重政治及Anthropic立场

  • NVIDIA正式启动开放安全AI联盟:黄仁勋强调,攻击者已拥有强AI,防御者需构建涵盖开放与封闭前沿模型的生态系统,配合共享工具和研究。该联盟成员包括微软、Hugging Face、LangChain、Nous Research等,主张防御能力和审计需开放访问模型及相关数据。

  • Anthropic澄清其开放权重立场:面对未签署NVIDIA公开信的批评,Anthropic声明从未主张禁止开放权重模型,支持对中国芯片出口管控、反工业级蒸馏措施及对足够能力模型(开放或封闭)强制安全测试。对此反应不一,有人认为合理澄清,也有人认为仍在拖慢前沿扩散。

  • 政策压力加剧,预发布审查成趋势:有报道指出,美国政府可能要求对前沿系统进行最长30天的预发布评估,涉及NSA和CAISI等机构,开放与封闭模型的区别尚未明确。结合Anthropic声明和OpenAI的华盛顿简报,前沿模型发布正成为治理接口,而非单纯产品发布。

基准测试、评估与代理可靠性

  • K3早期评测表现优异,尤其在代理和编码任务:在Agent Arena中,Kimi K3 Max在开放权重模型中排名第一,净提升9.75%,在多个指标上领先,包括成功率和可引导性。其在Frontend Code Arena中也夺冠。Cognition称K3是首个接近前沿性能的开源模型,FrontendCode 1.1得分58.2%,通过率63.6%。

  • Claude Opus 5表现强劲但反馈复杂:Opus 5 Max在多个排行榜中名列前茅,但开发者反馈存在过度复杂、易崩溃和停止行为不佳等问题,显示公开评测成绩与实际生产效用存在差异。

  • 新评测聚焦序列退化和隐性回归:EvoCode评测涵盖26个任务和227轮连续测试,检测代理是否能在满足新需求的同时保持旧功能。另一研究指出,技能增强虽带来收益,但也导致大量任务回退,警示盲目增加技能的风险。

  • 多模块强化学习系统出现“角色漂移”:端到端强化学习虽提升整体准确率,但模块可能悄然放弃原有职责,如分解器直接嵌入答案而非结构化问题,对多模块系统设计提出挑战。

模型与系统基础设施:从代理强化学习到流式视觉语言模型

  • 微软与NVIDIA均发布重要基础设施和模型更新:微软推出Mage-VL 4B,一款针对直播事件理解的编解码器原生流式视觉语言模型。NVIDIA发布Molt,一款PyTorch原生的代理强化学习框架,设计紧凑便于人类和AI编码助手理解,体现了“AI可读研究基础设施”的新理念。

  • AMD发布更具复现性的开放MoE模型:Instella-MoE为AMD首个完全开放的MoE语言模型,16亿参数(2.8亿激活),基于MI300X/MI325X训练,发布了从预训练到强化学习的检查点、配置、数据混合及代码,堪称全栈研究成果。

  • Cohere及开发者工具厂商强调“掌控工具链”:Cohere推出North Automations,基于其安全代理平台的自然语言工作流层。LangChain生态继续强调企业应掌控工具、提示、上下文和记忆,而非仅租用模型访问权。这一理念在开放模型和企业代理部署中反复出现。

热门推文

  • Kimi K3发布,包含2.8万亿开放权重及相关内核和基础设施。
  • NVIDIA黄仁勋关于开放防御AI及Hugging Face事件的论述引发广泛关注。
  • Ilya Sutskever关于安全超级智能计算扩展的讨论。
  • OpenAI推动工作模式和云代理,标志着从聊天机器人向嵌入式自动化转变。

AI Reddit回顾

/r/LocalLlama 和 /r/localLLM 讨论摘要

1. Kimi K3开放权重及部署计算

  • Kimi K3权重现已发布:模型为图像文本转换Transformer,使用Safetensors格式,需自定义代码,许可为kimi-k3。上月约3800点赞,2850次下载。讨论集中在硬件可行性,1040亿激活参数意味着极高的推理内存需求,普通消费级GPU难以运行。

  • Kimi K3权重今日发布,计划在A100、H200和B300上部署:估算8×A100 80GB显存不足以容纳权重,需多节点分片;8×H200约1.13TB显存仍需多节点;8×B300约2.3TB显存是唯一单节点可行配置。预计A100性能较差。讨论涉及高昂部署成本及尝试在Intel Gaudi加速器上运行的可能性。

2. 开放权重AI安全与政策争议

3. 可本地运行模型及编码工具评测

(无具体内容)


本文旨在梳理近期开放权重模型发布及相关安全、政策动态,尤其聚焦Moonshot AI的Kimi K3模型及其技术和生态影响。