内容提要
DeepSeek于2026年9月10日发布V4.1 Flash,官方称其在性能、速度和成本上全面超越旗舰V4 Pro,并将所有Pro的API请求强制路由至Flash,按低价计费。Flash生成速度达每秒284 token,约为Pro的三倍,且同步降价。V4 Pro上线仅40天即被放弃,V4.1 Pro仍在开发中,细节未公开。
延伸解读
强制路由:用户付高价却得低价服务
DeepSeek将Pro的API请求全部路由至Flash,并按Flash价格计费。这意味着在V4.1 Pro上线前,原Pro用户支付三倍费用,实际获得的是Flash的响应。官方逻辑是Flash全面超越Pro,继续提供更差更贵的Pro不合理。但商业上,用户可能不知情或没得选,这实质是强制平替,引发对定价透明度和用户信任的质疑。
速度提升不等于总耗时更短
V4.1 Flash生成速度达每秒284 token,约为Pro的三倍,但实测显示复杂任务中总耗时可能反而更长。因为模型调用工具验证的时间增加,且同计费下总花费比旧版V4 Flash高36%。这说明“智能密度”提升虽减少单步计算,但更聪明的模型可能执行更多步骤,导致token消耗增加,实际效率需综合评估。
架构级优势:后训练难以弥补
V4.1 Flash是DeepSeek首款原生多模态模型,出厂自带图文一体化输入输出,而非外挂视觉编码器。测试中同一图片描述任务,V4.1仅用7.6秒,旧Flash耗时751秒,差距近100倍。这显示架构层面的革新带来质的飞跃,后训练优化无法追赶。Flash的迭代已从后训练升级转向架构更新,这可能是其全面超越Pro的关键。
Pro产品线定位模糊,未来存疑
V4 Pro上线仅40天即被放弃,V4.1 Pro虽在开发中,但无模型卡、技术报告或端点信息,细节未知。若Flash每次迭代都能超越上一代Pro,Pro的存在意义便受挑战。DeepSeek可能自身也未明确Pro与Flash的边界。强制路由将持续至V4.1 Pro上线,但若其延迟发布,Pro用户将长期支付高价却获得Flash服务,产品线定位亟待澄清。
Q&A
DeepSeek V4.1 Flash是什么时候发布的?
DeepSeek于2026年9月10日正式发布V4.1 Flash模型。
DeepSeek为什么把V4 Pro的API请求全部路由到V4.1 Flash?
因为官方称V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro,且价格更便宜,所以将所有Pro的API请求路由到Flash,并按Flash的便宜价格计费。
V4.1 Flash相比V4 Pro在速度上有哪些提升?
V4 Pro生成速度约每秒97个token,V4.1 Flash达到每秒284个token,接近三倍,有开发者测出507 tokens/s的峰值。在49k超长上下文检索场景下处理速度快了5.2倍,SVG代码生成快了6.0倍,Manacher回文算法题解答快了4.6倍。
V4.1 Flash的价格调整具体是怎样的?
自2026年9月10日中午12点起,Flash系列降价:空闲时段缓存命中输入从0.05元降到0.02元每百万token,降幅60%;缓存未命中输入从1.5元降到1元;输出从4.5元降到4元。
V4 Pro被放弃后,现有Pro用户会受到影响吗?
会。在V4.1 Pro上线之前,所有调用V4 Pro的用户实际拿到的是V4.1 Flash的响应,但Pro用户仍按Pro的三倍价格付费,却得到更便宜模型的服务。
V4.1 Pro目前是什么状态?
V4.1 Pro正在开发中,DeepSeek技术团队成员崔天翼在社交平台上证实了其存在,但没有任何模型卡、技术报告或端点回应,具体参数和发布时间未知。
V4.1 Flash在架构上有什么特别之处?
V4.1 Flash是DeepSeek第一款原生多模态模型,出厂就自带图文一体化输入输出,不是外挂视觉编码器。有测试显示,同一张图片的描述任务,V4.1用了7.6秒,旧Flash跑了751秒,差了近100倍。
什么是DeepSeek提出的“智能密度”?
“智能密度”指用更少的计算资源产出更多的智能。DeepSeek在2025年12月的V3.2报告中首次提出,目的是为了在达到顶级模型输出质量的同时,减少等待时间。
V4.1 Flash在实际使用中可能存在哪些问题?
有开发者测试发现,模型吐字更快但交付未必更快,因为复杂任务中调用工具验证的时间更长,总耗时可能反而增加;在降价前计费标准下,同计费总花费比旧版V4 Flash高36%。