DeepSeek Flash价格回调至两分钱,V4.1六倍速度剑指Pro

DeepSeek Flash价格回调至两分钱,V4.1六倍速度剑指Pro

💡 原文中文,约3800字,阅读约需9分钟。
📝

内容提要

DeepSeek Flash系列API价格回调,缓存命中降至每百万tokens两分钱,输出四元,速度提升六倍。此举旨在应对竞争和信任危机,背后是V4.1新模型成本下降。开发者反应不一,部分因涨价流失,降价难挽回。V4.1内测或取代Pro,成为主力,反映AI商业化中价格与信任的博弈。

🔎

延伸解读

缓存命中才是定价核心

DeepSeek Flash的降价重点不在输出价格,而在缓存命中价格降至0.02元/百万tokens。开发者实测显示,接入Claude Code时缓存命中率高达99%,意味着绝大多数输入直接从缓存读取,成本极低。这种定价策略旨在锁定高频用户,用输出价格覆盖边际成本,用得越多、越依赖缓存,单次成本越低。

信任危机比价格更致命

尽管价格回调,但部分开发者表示不会回归,认为涨价伤害了信任。有用户转向其他模型或订阅制,直言“这是信任问题,不是价格问题”。创始人曾表示不在乎API用户,加剧了不满。价格可以回调,但信任一旦断裂,难以修复,这反映出AI商业化中价格与信任的博弈。

V4.1内测暗示战略转向

降价同日开启V4.1 Flash内测,速度提升六倍,官方问卷询问能否全面替换V4 Pro,暗示其可能成为主力模型。技术细节显示推理计算量降至V3.2的27%,KV Cache占用约10%,成本下降是降价的底气。这不仅是让利,而是通过新模型重新定义价值,让用户为更高性能付费。

效率提升或致总账单增加

有开发者反馈内测模型计费与V4 Flash相同,但速度快导致token消耗加快,5分钟花费10元。官方所称“成本更低”可能指底层推理效率,而非开发者账单。技术越高效,用户可能使用更多,总支出反而上升,形成悖论。

Q&A

DeepSeek Flash API 最新价格是多少?

DeepSeek Flash 系列 API 价格已回调,空闲时段缓存命中每百万 tokens 0.02 元,缓存未命中 1 元,输出 4 元;高峰时段价格翻倍。

DeepSeek Flash 为什么降价?

降价主要是为了应对竞争和信任危机。此前涨价导致用户流失,同时竞争对手如 GLM 5.3 Flash 和 Muse Spark 1.3 给出更低价格,迫使 DeepSeek 回调价格以挽回开发者。

DeepSeek V4.1 Flash 相比 V4 Flash 有哪些提升?

V4.1 Flash 采用全新模型结构,原生多模态支持,速度提升显著:SVG 代码生成快 6 倍,长上下文检索快 5 倍多。

DeepSeek Flash 的缓存命中价格为什么这么低?

缓存命中价格极低(0.02 元/百万 tokens)是为了锁定高频用户,因为大多数输入可直接从缓存读取,成本几乎为零,而输出价格覆盖边际成本。这种定价策略鼓励开发者依赖缓存,从而降低单次使用成本。

DeepSeek 涨价后开发者反应如何?

涨价后开发者反应强烈,部分用户流失,转向其他平台如 GLM Flash 和 Muse Spark。Reddit 上有开发者表示即使降价也不会回来,因为信任已经受损。

DeepSeek V4.1 Flash 是否会取代 V4 Pro?

官方问卷询问内测用户 V4.1 Flash 能否全面替换 V4 Pro,暗示其可能成为主力模型。V4.1 在速度和成本上优势明显,但尚未正式确认。

DeepSeek 降价后开发者会回流吗?

部分开发者可能回流,但许多开发者表示即使降价也不会回来,因为信任问题比价格更重要。例如有开发者认为 GLM Flash 和 Muse Spark 更稳定,且创始人曾表示不在乎 API 用户,导致信任破裂。

DeepSeek Flash 的定价策略反映了 AI 商业化的什么难题?

反映了技术效率提升与收入增长之间的矛盾。虽然单位成本下降,但公司需要盈利,涨价会流失用户,降价则可能影响收入。真正的解法是让用户为更高价值付费,而非单纯低价竞争。

🏷️

标签

➡️

继续阅读