深度求索原计划将DS V4 Pro请求自动路由至新上线的DS V4.1 Flash,因部分开发者反对,将V4 Pro下线时间从9月10日推迟至9月14日12:00,之后仍会强制路由,开发者需尽快适配。
深度求索将于9月10日发布DS V4.1 Flash模型,性能、费用和速度全面超越V4 Pro。发布后,V4 Pro请求将自动路由至V4.1 Flash,并按新价格计费,成本更低。用户可提前测试中间版本,正式版上线后价格更优。
深度求索宣布DS V4 Flash模型将于9月10日降价,缓存命中降幅60%,未命中降33%,输出仅降11%。相比8月17日涨价前,仅闲时缓存价格持平,其他模式仍贵100%至300%,整体降幅有限。
深度求索正在内测DS V4.1 Flash模型的中间版本,采用新结构,支持原生多模态,能力更强、速度更快、成本更低。内测用户调用速度可达300至600tok/s,但正式版可能无法达到此水平。该版本价格与V4 Flash相同,限流20并发,非内测用户也可尝试调用。
深度求索宣布自2026年8月23日起调整API峰谷计价,周六、周日全天设为闲时,价格更便宜;周一至周五分高峰和闲时,高峰价更高。新机制下,周末调用成本降低,具体价格如V4 PRO闲时输入未命中缓存每百万4.5元,高峰9元。
宇树科技科创板上市,DeepSeek母公司深度求索认购1.41亿元股份,锁定期36个月。双方将战略合作,让大模型成为机器人“大脑”,机器人成为AI“身体”,共同研发通用人工智能,推动具身智能产业化。
深度求索(DeepSeek)回应用户反馈,表示输入特殊字符<think>时模型返回无关内容,属于模型幻觉,不涉及隐私泄露。技术团队已修复此问题,并将增强模型对特殊字符的识别能力,以优化用户体验。
深度求索(DeepSeek)回应用户反馈,表示输入特殊字符<think>时模型返回无关内容属于模型幻觉,不涉及隐私泄露。技术团队已修复此问题,并增强模型对特殊字符的识别能力,以确保用户数据安全和使用体验。
深度求索发布的V4模型性能接近美国顶尖产品,价格仅为其十分之一,且开源免费,吸引了全球企业,尤其是中小企业。尽管技术上仍有差距,但其策略有效应对了美国企业面临的地缘政治风险和经济压力。
深度求索公司推出的deepseek-v3和deepseek-r1大语言模型已达到顶级水平,且免费开源。尽管显卡资源需求较少,但训练成本高,普通用户难以部署全尺寸模型,通常只能使用小型蒸馏版本。LM Studio可在本地运行简化模型,适合学习和知识检索。
深度求索开源了DeepSeek-Coder-V2模型,是全球首个在代码、数学能力上超越GPT-4-Turbo等的开源代码大模型。DeepSeek-Coder-V2包含236B与16B两种参数规模,支持338种编程语言。SiliconCloud上线了DeepSeek-Coder-V2开源模型,并提供大模型推理加速服务。新用户还送1亿token。
完成下面两步后,将自动完成登录并继续当前操作。