➡️
继续阅读
-
MetaRoCE:为AI规模以太网构建的新型RDMA传输协议
Meta发布MetaRoCE,一种为AI工作负载设计的全新RDMA传输协议,基于以太网,支持百万GPU规模。它通过端点智能、原生多路径、乱序交付和丢包容忍...
-
Databricks如何利用AI加速事件调查
Databricks开发了AI SRE调试代理,用于在事件发生时自动关联信号、执行运行手册,帮助值班工程师快速定位根因。它通过分层架构(原语、API、核心...
-
开发者如何利用Gemma 4构建有益于社会的AI
谷歌Gemma 4 Good挑战赛公布获奖项目,旨在用AI解决现实问题。获奖方案包括辅助老人和残障人士的机器人GEM-4、支持残障教师的语音白板Trido...
-
AI时代代码验证为何比以往更重要
AI时代代码验证比以往更重要。AI工具能快速生成大量代码,但验证其正确性和安全性成为难题。代码验证通过多层过滤器(类型检查、测试、人工审查等)确保代码可靠...
-
XPU如何成就世界级AI工厂
NVIDIA推出NVLink Fusion,将定制XPU与其成熟AI基础设施结合,帮助超大规模和AI原生公司构建灵活、可扩展的AI工厂。该方案提供高性能N...
-
每瓦特性能提升高达30倍:NVIDIA Vera Rubin NVL72为AI代理树立新效率标准
NVIDIA Vera Rubin NVL72在代理式AI工作负载中,每兆瓦吞吐量比GB300 NVL72高30倍,每百万token成本低35倍。该平台通...