内容提要
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管制,但训练仍依赖英伟达。华为产能和软件生态是主要挑战,交付或需一年以上。
延伸解读
推理与训练的分工逻辑
DeepSeek将16万颗华为芯片用于推理而非训练,反映出国产芯片在训练场景下仍存在短板。训练对算力、通信和软件生态要求极高,而推理相对成熟。这种分工策略既降低了成本,又规避了训练环节对国产芯片的依赖风险,但同时也意味着DeepSeek在核心训练上仍离不开英伟达。
成本与电价的考量
乌兰察布数据中心选址背后是成本考量:当地电价低至0.35元/度,年均气温4.3℃利于自然冷却,且距北京仅4.2毫秒时延。这些因素显著降低运营成本,支撑DeepSeek的降价策略。推理任务对芯片性能要求较低,但持续运行耗电巨大,因此选择电价低廉的地区是合理的经济决策。
华为产能与交付风险
华为950DT芯片2026年产量预计仅数十万颗,而DeepSeek一单就占16万颗,加上其他客户需求,交付周期可能超过一年。高端存储等零部件短缺进一步制约产能。这意味着订单能否按期落地存在不确定性,可能影响DeepSeek的算力扩张计划。
软件生态的隐性挑战
华为的CANN生态与英伟达CUDA相比仍有差距,全球开发者对CUDA的贡献使其生态更成熟。DeepSeek将华为芯片用于推理,部分原因是推理软件栈相对简单,对生态依赖较低。但长期看,若国产芯片要承担更多训练任务,软件生态的完善仍是关键瓶颈。
Q&A
DeepSeek采购华为AI芯片的用途是什么?
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练。
DeepSeek为什么选择华为芯片做推理而不是训练?
因为华为芯片在训练方面性能不足,但推理任务对芯片要求较低,华为芯片已足够使用,且成本更低,还能规避美国管制风险。
华为昇腾950DT芯片的性能如何?
昇腾950DT采用双Die统一内存架构,配备144GB HBM内存,内存带宽4TB/s,互联带宽2TB/s,性能对标英伟达Hopper架构,但受零部件短缺影响,2026年产量有限。
DeepSeek为什么选择在乌兰察布建设数据中心?
因为乌兰察布电费便宜(0.35元/度)、气候寒冷利于自然散热、离北京近(时延4.2毫秒),且当地算力规模全国领先。
16万颗华为芯片的算力规模有多大?
16万颗芯片规模超过xAI的10万卡集群、深圳的1万颗集群等,但若按4颗华为芯片对标1颗英伟达GPU计算,总算力仅相当于4万颗英伟达GPU。
华为芯片的软件生态与英伟达相比如何?
英伟达的CUDA生态成熟,全球开发者贡献代码;华为有自研CANN,但生态丰富度不足,推理软件栈相对成熟,因此DeepSeek用华为做推理可规避生态短板。
美国管制对DeepSeek采购华为芯片有何影响?
美国管制限制英伟达高端芯片对华销售,迫使中国企业转向国产芯片,为华为创造了市场机会,但DeepSeek训练仍依赖英伟达,甚至可能违规使用Blackwell芯片。
DeepSeek采购华为芯片的经济考量是什么?
DeepSeek通过自建算力降低运营成本,以支持低价策略(如V4-Pro降价75%),用华为芯片做推理可降低长期成本,同时规避风险。
华为能否按时交付16万颗芯片?
华为2026年950DT产量仅数十万颗,且需兼顾其他客户,加上高端存储短缺,交付可能需一年以上,存在不确定性。