➡️
继续阅读
-
微软的Project Zenith是面向开发者的‘无干扰Windows体验’
微软推出“Project Zenith”开发者专用Windows体验,首批设备搭载AMD Ryzen AI Halo芯片,配备64GB以上统一内存,可本地...
-
Allora Labs证明变异AI模型群体性能超单个优化模型
Allora Labs研究表明,在AI模型群体中引入随机变异可提升整体性能,超越单个优化模型。变异群体在环境变化时表现更优,最佳情况下约80%优于优化群体...
-
【Rust日报】2026-09-05 OpenVMM 跨平台 Rust VMM 进展
微软开源跨平台Rust虚拟机管理器OpenVMM,支持x64与AArch64架构,增强KVM、MSHV后端及设备仿真,机密计算优化使TDX开销降至1%。另...
-
Qwen3.8: 从 0 到 1 用 Rust 重写 Mooncake: Suncake
本文介绍作者用Rust重写Mooncake存储模块为Suncake项目,通过Qoder和Qwen3.8从零开发,仅用37个提交完成。相比C++版,性能提升...
-
推理服务的缓存与调度:前缀、多级存储、集群路由
本文讨论长上下文推理服务的缓存与调度优化。核心原则是缓存未命中比命中贵几个数量级,因此设计围绕复用展开:单实例内通过块哈希实现前缀缓存;KV池采用writ...
-
显存账本:每张卡上住着什么,搬走付什么
本文介绍训练大模型时显存管理的通用记账方法。显存分为五类:权重、梯度、优化器状态、激活和通信缓冲。前三类由参数量和并行度决定,激活随输入长度增长,优化空间...