➡️
继续阅读
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
DeepSeek采购160000颗华为AI芯片:专攻推理不碰训练
DeepSeek计划采购16万颗华为昇腾950DT芯片,用于内蒙古乌兰察布数据中心的推理任务,而非训练,订单约25.6亿美元。此举旨在降低成本、规避美国管...
-
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
星尘智能发布SmoothRL框架,解决真实机器人异步执行中的在线强化学习问题。该框架仅对实际执行的动作进行学习,并保持训练与部署节奏一致。在投掷、戴笔帽、...
-
Linux Kernel 7.1已经结束生命周期不再提供更新 用户应尽快升级到7.2系列
Linux Kernel 7.1系列已结束支持,最终版7.1.13于9月2日发布,含76项修复。该非LTS版本生命周期短,官方建议用户升级至7.2系列或L...
-
用 ChatGPT 定时任务做一个 Hacker News 中文摘要网站
作者利用ChatGPT定时任务自动抓取Hacker News前30条,生成中文摘要并筛选兴趣内容,通过Eleventy构建静态网站hn-digest并发布...
-
CEO的1元年薪起源 - 编程一生
本文介绍了多个商业现象的起源:手机系统更新导致变慢源于安迪-比尔定理,即软件消耗硬件提升;CEO拿1元年薪始于克莱斯勒和乔布斯,象征共渡难关;公司延迟上市...