在华尔街沉睡之际,一款由中国研发的大型语言模型悄然跃升,超越了16个竞争对手,登顶AI排行榜。

这款名为Kimi-K3的模型由北京Moonshot AI公司开发。周四,AI基准测试平台Arena.ai宣布,Kimi-K3在“前端代码竞技场”中,从第17名一跃成为第一名,远远领先于备受关注的Claude Fable 5和GPT-5.6 Sol。

在“文本竞技场”——衡量模型在文本生成和创意写作等任务中的表现方面,Kimi-K3也取得了第九名的好成绩,较Moonshot AI之前的Kimi-K2.6模型(排名第38)有了显著提升。

此消息发布之际,投资者正面临重大考验。美国半导体股周五早盘大幅下跌,纳斯达克综合指数下滑1.4%。这加剧了科技股本周的惨淡表现,市场对美国AI泡沫的担忧持续发酵。

“Moonshot”这一名称或许还不足以形容此次突破。关键在于,这款中国AI模型不仅在前端编码基准测试中超越了所有美国设计的模型,而且采用了截然不同的技术路径。

与去年令美国股市震动的另一款中国AI模型DeepSeek类似,Kimi是一款开放权重模型,意味着其内部机制对公众开放。相比于像GPT-5.6这类严格保密的专有模型,开放模型的使用成本平均低六倍,尽管其性能历史上略逊一筹。

对此消息,前Meta高级产品经理、现AI创业者曲晓音提出了关键问题:“当最好的开放权重模型超过了最好的闭源模型时,[Anthropic]如何为其Fable定价辩护?为什么还要有人为此买单?”

在Kimi-K3发布之前,闭源模型仅凭稍微优越的性能就能让用户支付高达六倍的费用,这一现象已推动美国企业转向中国AI。如今性能差距迅速缩小,企业和个人支付硅谷前沿模型高昂价格的理由愈发不足。

这一简单的经济逻辑对美国科技行业无疑是坏消息。多年来,美国一直坚称AI的成功需要投入数万亿美元。

正如曲晓音所言:“Kimi最近一轮融资估值为200亿美元,而Anthropic估值近1万亿美元,是其50倍。为什么?”

更多AI资讯: 中国法院裁定工人不能被AI替代