
曾经震撼股市的DeepSeek,再次推出了超越其高级Pro版本的新型AI模型,并且免费公开。日本时间9月10日,DeepSeek发布了支持图像识别的新一代AI模型“DeepSeek-V4.1-Flash”。同日,该模型的开放权重(模型参数)以MIT许可证形式在Hugging Face平台免费发布。该模型总参数量达到5520亿(552B),在多项代理人基准测试中全面击败了高级版本“DeepSeek-V4-Pro-0813”,并在部分项目上超过了Anthropic的“Claude Opus 5”。
DeepSeek-V4.1-Flash基于新一代架构,采用多模态的MoE(专家混合)模型结构。MoE通过将模型内部划分为多个功能不同的小型网络,根据输入动态激活所需部分,从而降低计算量。总参数为5520亿,活跃参数在读取输入时为80亿,生成输出时为160亿。输入和输出阶段参数数量不同,是因为采用了输入和输出网络分离的非对称结构。
该模型支持文本和图像输入,最大上下文长度达100万token,建议最大输出长度超过25.6万token。采用MIT许可证,允许商业使用、修改和再分发,完全免费。
DeepSeek-V4.1-Flash全面胜出高级版V4-Pro,部分指标超越Opus 5
根据DeepSeek公布的基准测试结果,代理人相关的12个测试项目中,DeepSeek-V4.1-Flash均优于高级版本DeepSeek-V4-Pro-0813。例如代码修正测试“DeepSWE v1.1”得分74.2对62.7,业务自动化测试“AutomationBench”得分54.8对43.2,差距明显。与Claude Opus 5比较时,DeepSWE v1.1以74.2略胜74.0,AutomationBench也以54.8领先50.3。

不过,在难题测试“HLE”中,DeepSeek-V4.1-Flash得分36.8,远低于Claude Opus 5的56.3。在科学知识测试“GPQA Diamond”中,DeepSeek-V4-Pro-0813以90.9稍逊于Claude Opus 5的92.4。HLE测试在仅文本条件下,DeepSeek-V4.1-Flash得分39.1,也未达到42.7。
新结构“CED”实现KV缓存压缩至四分之一
DeepSeek-V4.1-Flash性能与成本兼顾的关键在于其名为“Causal Encoder-Decoder(CED)”的新结构。该模型共40层,分为前20层负责读取输入,后20层负责生成输出。读取阶段较轻,降低了处理大量资料和日志的成本并提升速度。会话上下文的KV缓存不再在后半部分各层单独保存,而是由前半部分读取结果生成。

此外,KV缓存本身也大幅压缩,单token占用890字节,仅为上一代DeepSeek-V4-Flash的约四分之一。缓存体积减小直接降低了服务器内存和SSD的消耗,有助于长时间运行的AI代理降低运营成本。
DeepSeek API降价,V4-Pro版本将于9月14日切换至V4.1-Flash
自日本时间9月10日下午1点起,DeepSeek API开始提供新版本并下调价格。旧版本DeepSeek-V4-Flash及DeepSeek-V4-Flash-Vision-Exp停止提供,旧版本调用请求暂时转发至DeepSeek-V4.1-Flash。高级版本DeepSeek-V4-Pro也将于9月14日下午1点起切换至V4.1-Flash的调用和计费。
DeepSeek表示,此次转发措施将持续至V4.1-Pro版本发布,但截至9月10日,V4.1-Pro的具体发布时间和规格尚未公布。
DeepSeek-V4.1-Flash开放权重版主要规格
- 仓库地址:Hugging Face上的“deepseek-ai/DeepSeek-V4.1-Flash”,采用MIT许可证,允许商业使用、修改和再分发
- 模型规模:总参数5520亿,MoE结构。活跃参数为输入时80亿,输出时160亿
- 图像输入:默认支持,可同时输入文本和图像
- 上下文长度:100万token,建议最大输出长度超过25.6万token
- KV缓存:每token占用890字节,约为上一代的四分之一
- 推理强度:可设定1至100的整数,数值越大计算成本越高,准确率提升
DeepSeek API新价格及旧模型迁移说明
- 非高峰时段价格:每百万token输入0.15美元(约23日元),输出0.6美元(约92日元);缓存命中时输入仅0.003美元(约0.5日元)
- 高峰时段价格:非高峰的两倍,输入0.3美元(约46日元),输出1.2美元(约185日元)
- 高峰时段定义:日本时间工作日10:00-13:00及15:00-19:00,周末及节假日均为非高峰
- 旧模型处理:DeepSeek-V4-Flash及DeepSeek-V4-Flash-Vision-Exp停止提供,旧版本调用暂时转发至DeepSeek-V4.1-Flash
- V4-Pro转发:自9月14日下午1点起,V4-Pro调用转发至V4.1-Flash,计费按V4.1-Flash标准,直至V4.1-Pro发布

