内容提要
DeepSeek V4.1 Flash 已上线 AI Gateway,支持原生图像理解,可在同一请求中处理文本和图片,用于解读截图、图表等。模型上下文窗口达100万token,最多输出38.4万token,支持推理、工具调用和提示缓存。新架构分离输入与输出组件,降低各阶段计算量。AI Gateway 提供统一API,无加价和平台费。
延伸解读
原生图像理解的实际应用
DeepSeek V4.1 Flash 支持原生图像理解,能在同一请求中处理文本和图片。这意味着你可以直接上传截图、图表等视觉内容,并针对它们提问或提取信息,无需额外的图像识别步骤。对于需要分析视觉数据的任务,如解读报表或从界面截图中获取信息,这提供了更直接的交互方式。
大上下文窗口与输出能力
模型拥有100万token的上下文窗口,并能生成最多38.4万token的响应。这适合处理长文档、复杂对话或需要大量输出的场景。同时,它支持推理、工具调用和提示缓存,有助于在保持性能的同时降低重复计算的开销。
新架构的计算优化
V4.1 Flash 采用新架构,将输入处理和输出生成分离为独立组件。这种设计减少了每个阶段所需的活跃计算量,可能带来更高效的推理过程。对于需要频繁调用模型的开发者,这有助于控制成本并提升响应速度。
AI Gateway 的集成与成本
通过 AI Gateway 使用该模型,可以享受统一API、用量跟踪、重试和故障转移等功能。Gateway 按提供商定价收费,无加价且不收取平台费,包括自带密钥(BYOK)请求。这为开发者提供了透明的成本结构和更高的可用性保障。
Q&A
DeepSeek V4.1 Flash 在 AI Gateway 上线后,主要新增了什么能力?
新增了原生图像理解能力,支持视觉功能,可以在同一个请求中同时接受文本和图片,用于解读截图、阅读图表以及从视觉内容中提取信息。
DeepSeek V4.1 Flash 的上下文窗口和最大输出长度是多少?
上下文窗口为 100 万 token,最大输出长度为 38.4 万 token。
DeepSeek V4.1 Flash 支持哪些高级功能?
支持推理、工具调用和提示缓存。
DeepSeek V4.1 Flash 的新架构有什么特点?
新架构将输入处理和输出生成分离为独立组件,从而减少每个阶段所需的活跃计算量。
如何在代码中调用 DeepSeek V4.1 Flash?
使用模型名称 deepseek/deepseek-v4.1-flash,例如通过 streamText 函数传入该模型名称和提示词即可调用。
AI Gateway 提供哪些服务,是否收取额外费用?
AI Gateway 提供统一 API,用于调用模型、跟踪使用量和成本,并配置重试、故障转移和性能优化,以实现高于提供商的上线时间。它还包含内置自定义报告、零数据保留支持、API 密钥预算、路由规则等。定价反映提供商价格,无加价,也不对推理收取平台费,包括自带密钥(BYOK)请求。