DeepSeek发布V4.1-Flash,重点在架构革新而非跑分。模型总参数552B,预填充仅激活8B、解码16B,支持百万token上下文,全局KV缓存降至每token 890字节。通过因果编码器-解码器、压缩稀疏注意力CSA2、FP4缓存等技术,大幅降低长上下文推理成本。在终端、编程、网络安全等智能体基准上表现领先,以MIT许可开源,为长时运行AI智能体提供更高效方案。
完成下面两步后,将自动完成登录并继续当前操作。