➡️
继续阅读
-
DeepSeek采购160000颗华为AI芯片:专攻推理不碰训练
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管...
-
Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake
本文介绍作者用Rust重写Mooncake存储模块为Suncake项目,通过Qoder和Qwen3.8从零开发,仅用37个提交完成。相比C++版,性能提升...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
Facet-0——用价值引导的 RL 教会 VLA 精密装配:动作–力觉联合预测,让接触可预测、可估值(把价值写进接触那一瞬)
Facet-0提出将接触视为动作的可预测结果,通过语义—接触表征联合生成动作与预期腕部扭矩,并基于ManuFacet-1K数据集训练。部署时用Action...
-
让 Apple Watch 记录的每一趟游泳数据更有意义:即刻游
对于使用AppleWatch游泳的人来说,记录一次游泳并不困难。在手表上打开体能训练App,选择开始游泳,结束后就能在Apple健身中看到完整的游泳表现,...