内容提要
DeepSeek发布V4.1 Flash内测版,速度快38%、省43% token,但单价未变,单位时间消耗更多导致“烧钱更快”。该模型限时两天,旨在测试能否以Flash价格提供Pro能力。对比Vision Exp,新模型效率更高,但存在小缺陷。DeepSeek正加速迭代,布局从模型到Agent的完整生态。
延伸解读
“成本更低”与“烧钱更快”为何并存
官方宣称“成本更低”是基于完成同一任务的总token消耗减少43%,而开发者感受到的“烧钱更快”是因为生成速度提升至每秒361个token,单位时间内消耗的token更多。单价未变,但时间尺度不同导致结论相反。理解这一点有助于用户根据自身使用场景(如高频交互或长任务)评估实际费用。
限时内测的意图与局限
模型ID中的“expires-on-0910”表明这是一次为期两天的压力测试,而非正式发布。官方问卷询问能否替代V4 Pro,暗示其目标是验证以Flash价格提供接近Pro能力的可行性。但20路并发限制和短暂窗口期意味着它更适合功能验证,不适合大规模生产环境。用户应谨慎对待此类实验性模型。
速度提升的实际价值与潜在代价
V4.1 Flash将生成1500字的时间从24.7秒压缩至4.4秒,在编程等需要频繁试错的场景中能显著提升效率。然而,速度过快可能导致模型在生成时来不及自我纠错,如测试中“鹈鹕骑车”的bug未被发现。用户需权衡速度带来的时间节省与潜在的质量风险,尤其在需要高准确性的任务中。
迭代速度背后的战略布局
40天内六次更新,涵盖模型、多模态和Agent工具(如Harness),表明DeepSeek正从单一模型提供商转向构建完整Agent生态。V4.1 Flash的速度提升与Harness的框架结合,旨在让AI能更快地自主调用工具完成任务。这一布局可能重塑开发者对AI能力的预期,但当前仍处于实验阶段。
Q&A
DeepSeek V4.1 Flash相比V4 Flash Vision Exp在速度和token消耗上有哪些提升?
根据开发者Diru14的对照测试,V4.1 Flash完成同一任务耗时18分49秒,比Vision Exp的30分11秒快38%;总token消耗11.59M,比Vision Exp的20.31M节省43%;生成速度361 tok/s,是Vision Exp的120 tok/s的三倍。
为什么DeepSeek V4.1 Flash速度更快、token更省,但开发者感觉花钱更快?
因为V4.1 Flash的单价与V4 Flash相同,但生成速度是Vision Exp的三倍,单位时间内消耗的token更多,导致账单累积速度更快。官方说的“成本更低”是指完成特定任务的总成本(总token减少),而开发者感受到的“烧钱更快”是单位时间内的支出速度。
DeepSeek V4.1 Flash内测的截止时间是什么时候?
V4.1 Flash的模型ID为deepseek-v4.1-flash-expires-on-0910,意味着它将在9月10日自动过期下线,内测窗口从9月8日到9月10日,只有两天。
DeepSeek V4.1 Flash内测的目的是什么?
DeepSeek通过限时内测收集极端场景下的真实反馈,并在问卷中询问用户该模型能否全面替换V4 Pro,旨在测试能否以Flash的价格提供接近Pro的能力,为正式版迭代提供依据。
DeepSeek V4.1 Flash相比V4 Flash Vision Exp在架构上有哪些改进?
V4.1 Flash采用全新模型结构,原生支持多模态,无需额外挂载视觉扩展包;有开发者推测它可能重做了预训练,因此token利用效率更高,能用更少的token完成相同任务。
DeepSeek V4.1 Flash在编程任务中的实际体验如何?
V4.1 Flash生成速度极快,持续吞吐355 tok/s,首字延迟178ms,生成1500字内容仅需4.4秒,比V4 Pro快5.7倍,能大幅缩短从想法到原型的时间,适合需要频繁试错的编程场景。
DeepSeek V4.1 Flash存在哪些缺陷?
内测中,V4.1 Flash生成的SVG动画中“鹈鹕骑车”场景看起来像在骑倒车,模型未发现该错误,说明它速度快但可能缺乏自我检查能力。
DeepSeek近期发布了哪些产品,体现了怎样的战略布局?
近40天内,DeepSeek连续发布V4 Flash正式版、V4 Pro、Harness开发者预览版、V4 Flash Vision Exp、Vision Exp开源及V4.1 Flash内测,覆盖模型、多模态和Agent开发工具,旨在构建从模型到Agent落地的完整生态。