➡️
继续阅读
-
DeepSeek采购160000颗华为AI芯片:专攻推理不碰训练
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
Kimi K3 模型结构(8):训练并行,一步训练里谁在等谁
本文介绍Kimi K3模型预训练的并行系统设计,聚焦MoE层expert并行。核心是MoonEP方案:每个rank预留E/R个冗余expert槽位,确保任...
-
Open Flow 开源后,我更关心 Agent 工作流怎么进生产
Open Flow是OOMOL Lab开源的AI Agent工作流自动化平台,支持可视化、CLI和自托管。文章聚焦其生产应用,强调运行时隔离、权限与日志管...
-
HyperAI 上新丨MCP接入开发工作流;PyTorch/AI for Beginners/TVM等系列教程上线;AI顶会资源检索功能再升级
HyperAI平台推出三项更新:上线MCP服务器,支持在Claude Code和Cursor中通过自然语言管理算力、数据集等资源;新增AI顶会(如AAAI...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...