➡️
继续阅读
-
Kimi K3 模型结构(10):RL 与服务,状态住在哪里
本文介绍Kimi K3模型在1M上下文强化学习与线上服务中的系统设计,核心是状态管理。KV块和KDA状态通过write-back策略在GPU与DRAM池间...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
英伟达买下Hugging Face的真正算盘
英伟达买下Hugging Face的真正算盘 英伟达为什么用129.3亿美金收购Hugging Face?这期从129303的Unicode表情与英伟达...
-
2026-09-06-前端与AI技术周报
本期覆盖 Electron 44.2、Bun 1.4、Vite 8.3 beta、Cursor 自托管机器与 Chrome 单轴滚动容器测试。
-
2026 09 06 HackerNews
2026-09-06 Hacker News Top Stories # Anthropic 团队用 Claude AI 在11天内完成了费马大...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...