DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调利好

2026-09-10 14:55:13
来源:IT之家
分享
文章提及标的

IT之家9月10日消息,深度求索今日正式发布DeepSeek V4.1Flash模型。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。

DeepSeek V4.1Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeek V4Pro在内的一众旗舰模型的智能水平。

▲ DeepSeek-V4.1-Flash与主流前沿模型在Agentic Benchmark(BHE)上的性能对比

此外,新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。

在 Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

如图展示了DeepSeek在减少上下文存储方面的持续进展。相对于初代模型,KV Cache是原来的1/437。

DeepSeek V4.1Flash已同步上线DeepSeek API,原生支持多模态,将模型名称更改为deepseek-flash即可调用最新的V4.1Flash模型。

旧版本模型V4Flash与V4Flash Vision Exp现已下线,出于兼容考虑,模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp将被暂时路由到V4.1Flash。

同时,经多方测试,V4.1Flash在性能、费用、速度、总用时等各项指标上已全面超越V4Pro,因此官方计划有序下线V4Pro模型。北京时间2026年9月14日12:00之后,至未来V4.1Pro上线之前,用户访问deepseek-v4-pro的请求将全部路由到V4.1Flash,并按V4.1Flash单价计费。

腾讯(WorkBuddy、CodeBuddy)和OpenCode作为官方合作伙伴,现已全量接入DeepSeek V4.1Flash。

得益于模型架构的创新,DeepSeek V4.1Flash能够以更低的成本服务更多的用户,因此官方相应下调了V4.1Flash的定价。

同时,为了更合理地调配资源,DeepSeek V4.1Flash仍然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格于2026年9月10日12:00开始生效。

IT之家附模型开源链接:

https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash

论文链接:

https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report.pdf

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME