人工智能

DeepSeek V4.1 Flash发布 全面超越V4 Pro

字号+作者:凤凰网科技 来源:凤凰网科技 2026-09-10 15:16 评论(创建话题) 收藏成功收藏本文

9月10日,DeepSeek官方宣布:正式发布DeepSeekV4.1Flash模型。官方称该模型是全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。经多方测试'...

9月10日,DeepSeek官方宣布:正式发布DeepSeekV4.1Flash模型。官方称该模型是全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。经多方测试,V4.1Flash在性能、费用、速度、总用时等各项指标上已全面超越V4Pro。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。MUN品论天涯网

非对称模型结构,小成本大智能MUN品论天涯网

DeepSeekV4.1Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeekV4Pro在内的一众旗舰模型的智能水平。MUN品论天涯网


MUN品论天涯网

DeepSeek-V4.1-Flash与主流前沿模型在AgenticBenchmark上的性能对比MUN品论天涯网


MUN品论天涯网

更少缓存,更省成本MUN品论天涯网

新一代模型大幅减少了KVCache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KVCache的压缩大幅降低了Agent类任务的使用成本。MUN品论天涯网


MUN品论天涯网

如图展示了DeepSeek在减少上下文存储方面的持续进展。相对于初代模型,KVCache已经缩小了437倍。MUN品论天涯网

API支持MUN品论天涯网

DeepSeekV4.1Flash已同步上线DeepSeekAPI,原生支持多模态,将模型名称更改为deepseek-flash即可调用最新的V4.1Flash模型。旧版本模型V4Flash与V4FlashVisionExp现已下线,出于兼容考虑,模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp将被暂时路由到V4.1Flash。MUN品论天涯网

同时,经多方测试,V4.1Flash在性能、费用、速度、总用时等各项指标上已全面超越V4Pro,因此我们计划有序下线V4Pro模型。北京时间2026年9月14日12:00之后,至未来V4.1Pro上线之前,用户访问deepseek-v4-pro的请求将全部路由到V4.1Flash,并按V4.1Flash单价计费。MUN品论天涯网

腾讯(WorkBuddy、CodeBuddy)和OpenCode作为官方合作伙伴,现已全量接入DeepSeekV4.1Flash,欢迎使用!MUN品论天涯网

API定价调整MUN品论天涯网

得益于模型架构的创新,DeepSeekV4.1Flash能够以更低的成本服务更多的用户,因此我们相应下调了V4.1Flash的定价。同时,为了更合理地调配资源,我们仍然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格于2026年9月10日12:00开始生效。MUN品论天涯网


MUN品论天涯网

模型开源MUN品论天涯网

我们将会全力支持开源社区进行新模型的推理适配,并尝试通过各种方式扩大部署的范围。如果您有大规模部署的需求且具备相应的资源(2k卡GPU、有存储集群),欢迎与我们联系。MUN品论天涯网

模型开源链接:MUN品论天涯网

https://huggingface.co/deepseek-ai/DeepSeek-V4.1-FlashMUN品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]