d-Matrix采用英伟达NVLink Fusion实现机架级XPU部署

d-Matrix采用英伟达NVLink Fusion实现机架级XPU部署

💡 原文英文,约900词,阅读约需4分钟。
📝

内容提要

d-Matrix宣布采用英伟达NVLink Fusion,将其下一代Raptor XPU接入英伟达AI基础设施平台,借助MGX机架架构和Spectrum-X网络,加速从定制芯片到大规模部署。该方案可降低延迟、缩短上市时间,并支持与英伟达GPU系统协同部署。

🔎

延伸解读

NVLink Fusion 如何降低 XPU 部署门槛

自研 XPU 的难点不仅在芯片本身,更在于构建机架级基础设施。NVLink Fusion 让 d-Matrix 直接接入英伟达的 MGX 机架架构、Spectrum-X 网络和液冷方案,省去从零搭建的环节。这有助于缩短上市时间,并降低集成高速接口、验证扩展网络等环节带来的成本和风险。

性能指标与生态伙伴

根据文章,NVLink Fusion 提供比现成以太网低 3 倍的 XPU 间延迟、高 10 倍的包速率,以及通过第六代 NVLink 实现每 XPU 3 TB/s 的全对全带宽。合作伙伴包括 d-Matrix、AWS、Arm、Intel、Fujitsu、Marvell、MediaTek、Samsung 等,覆盖芯片、IP 和光互连等领域。

对数据中心的实际意义

采用统一机架后,数据中心可以一次建设,同时支持 GPU、CPU 和 XPU,无需为每种处理器单独设计机架架构。d-Matrix 的机架还能与英伟达 GPU 系统(如 Vera Rubin NVL72)协同,实现解耦推理。这为在通用 AI 工厂内按工作负载匹配算力提供了灵活性。

Q&A

d-Matrix 采用 NVIDIA NVLink Fusion 具体要做什么?

d-Matrix 将使用 NVIDIA NVLink Fusion 将其下一代 Raptor XPU 连接到 NVIDIA 的 AI 基础设施平台,借助 NVLink 纵向扩展和 Spectrum-X 横向扩展网络、MGX 机架架构以及更广泛的 NVIDIA AI 平台,实现从定制芯片到大规模部署的加速、低风险路径。

NVLink Fusion 是什么?它解决什么问题?

NVLink Fusion 是 NVIDIA 的平台,用于将第三方定制 XPU 和 CPU 与 NVLink 纵向扩展网络、MGX 机架架构及完整 AI 工厂平台集成。它解决的核心问题是:构建定制 XPU 很难,大规模部署更难;NVLink Fusion 让 XPU 制造商跳过从零构建机架级基础设施,直接接入 NVIDIA 经过验证、全球部署的 AI 工厂平台。

NVLink Fusion 在性能上有哪些具体提升?

根据文章,NVLink Fusion 提供比现成以太网低 3 倍的 XPU 到 XPU 延迟、高 10 倍的包速率,以及通过第六代 NVLink 实现每 XPU 3 TB/s 的全对全带宽。

d-Matrix 如何将 XPU 集成到 AI 工厂中?

d-Matrix 计划使用 NVIDIA NVLink 将其 XPU 连接在单个高带宽、低延迟的纵向扩展域中。其机架还可以与 NVIDIA 基于 GPU 的系统(如 NVIDIA Vera Rubin NVL72)协同工作,用于分解式推理。d-Matrix 还计划集成 NVIDIA Vera CPU、ConnectX-9 SuperNIC、BlueField-4 DPU 和 Spectrum-X 以太网网络。

NVLink Fusion 支持哪些 CPU 架构和合作伙伴?

NVLink Fusion 支持所有主要 CPU 架构——Arm、x86 和 RISC-V,以及 NVIDIA GPU。合作伙伴包括 d-Matrix、AWS、Arm、Intel、Fujitsu、SiFive、Alchip、Astera Labs、GUC、Marvell、MediaTek、Samsung、Cadence、Synopsys、Ayar Labs 和 Lightmatter。

采用 NVLink Fusion 对 d-Matrix 和客户有什么好处?

对 d-Matrix 而言,NVLink Fusion 提供了加速、低风险的路径,使其能够利用 NVIDIA MGX 生态系统的成熟机架设计、供应链、电源和冷却基础设施,从而缩短上市时间。对客户而言,他们可以获得更快、更低风险的部署和扩展超低延迟推理的途径,并且数据中心可以一次构建,支持 GPU、CPU 和 XPU,而无需为每种处理器类型单独设计机架架构。

🏷️

标签

➡️

继续阅读