➡️
继续阅读
-
d-Matrix采用英伟达NVLink Fusion实现机架级XPU部署
d-Matrix宣布采用英伟达NVLink Fusion,将其下一代Raptor XPU接入英伟达AI基础设施平台,借助MGX机架架构和Spectrum-...
-
通过 CUDA 缓存技术实现 AI 模型部署加速
AI模型部署耗时主要来自加载权重、KV Cache初始化和CUDA内核编译。作者在T5000芯片上预编译CUDA内核,将cache、triton、nv等目...
-
2026年成为前线部署工程师的7个步骤
FDE(前线部署工程师)是AI热潮中的热门复合型岗位,融合软件工程、应用AI、系统设计与产品思维,2026年美国平均年薪约11.6万美元。文章给出七步路线...
-
码道深度对接CodeArts,让需求自动落地为代码
本文实测华为云码道代码智能体结合MCP对接CodeArts:配置MCP并鉴权八大服务后,仅用自然语言需求即可自动创建项目、生成五子棋游戏、推送代码仓;再借...
-
fastalp: 纯 Rust 打造的下一代 ALP 浮点无损压缩 — 25 GB/s 极速解码、压缩比提升 60%、压缩提速 2.6x
fastalp 是纯 Rust 实现的 ALP 浮点无损压缩算法,面向时序数据库与 IoT。相比 C++ 原版,端到端压缩提速 2.58 倍,解压达 25...
-
Radim Marek:再多一个索引的不可承受之轻
作者用30个模型测试PostgreSQL模式生成,发现编码智能体普遍过度建索引,尤其集中在写入最频繁的表上。16个索引使WAL写入增至1.8倍、更新耗时1...