DeepSeek V4 Pro 正式版上线,多项指标逼近 Fable 5

DeepSeek V4 Pro 正式版上线,多项指标逼近 Fable 5

💡 原文中文,约1100字,阅读约需3分钟。
📝

内容提要

DeepSeek V4 Pro正式发布,支持1M上下文和384K最大输出,具备思考模式、JSON输出、工具调用及API兼容。价格与旧版持平,每百万Token缓存命中输入0.025元,未命中输入3元,输出6元,并发限制500。Flash版更便宜且并发高,Pro面向高规格任务,强化Agent和编码场景。

🔎

延伸解读

价格与并发:Pro 与 Flash 的定位差异

Pro 版在缓存未命中输入和输出上的单价均为 Flash 的 3 倍,但并发限制仅为 Flash 的五分之一(500 vs 2500)。这种配置表明 Flash 面向高频、大规模调用,而 Pro 则更注重高规格任务,如复杂 Agent 和长代码处理。开发者应根据调用频率和任务复杂度选择合适的模型,以平衡成本与性能。

API 兼容性:降低迁移成本

deepseek-v4-pro 同时兼容 OpenAI 和 Anthropic 两套 API 格式,并支持 Responses API 和 Anthropic API,这有助于开发者从其他平台迁移时减少代码改动。此外,Beta 阶段的对话前缀续写和 FIM 补全(仅限非思考模式)为特定场景提供了额外灵活性,但需注意其测试性质。

上下文与输出长度:长任务处理的优势

1M 上下文和 384K 最大输出使模型能一次性处理长代码库或大规模文档,并生成较长的连续内容。对于需要多步骤推理的 Agent 任务,这种能力可减少多次调用的需求,但实际效果仍取决于任务复杂度和模型推理质量,建议开发者进行针对性测试。

Q&A

DeepSeek V4 Pro 正式版支持的最大上下文长度和最大输出长度是多少?

DeepSeek V4 Pro 正式版支持 1M 上下文长度,最大输出长度达到 384K Token。

DeepSeek V4 Pro 支持哪些功能?

DeepSeek V4 Pro 支持 JSON Output、Tool Calls、Responses API、Anthropic API,以及 Beta 阶段的对话前缀续写与 FIM 补全(FIM 补全仅限非思考模式)。

DeepSeek V4 Pro 的 API 定价是多少?

DeepSeek V4 Pro 每百万 Token 的价格为:缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元。

DeepSeek V4 Pro 和 V4 Flash 在价格和并发限制上有何区别?

V4 Pro 的价格在缓存未命中输入和输出上都是 Flash 的 3 倍(Pro 分别为 3 元和 6 元,Flash 为 1 元和 2 元),缓存命中输入价格相近(Pro 0.025 元,Flash 0.02 元)。并发限制上,Pro 为 500,Flash 为 2500。

DeepSeek V4 Pro 适合哪些应用场景?

V4 Pro 面向高规格任务,适合长代码库处理、大规模文档处理、需要连续执行大量步骤的 Agent 任务,以及 Coding 场景。

DeepSeek V4 Pro 的思考模式默认是开启还是关闭?

思考模式默认开启。

🏷️

标签

➡️

继续阅读