内容提要
d-Matrix宣布采用英伟达NVLink Fusion,将其下一代Raptor XPU接入英伟达AI基础设施平台,借助MGX机架架构和Spectrum-X网络,加速从定制芯片到大规模部署。该方案可降低延迟、缩短上市时间,并支持与英伟达GPU系统协同部署。
延伸解读
NVLink Fusion 如何降低 XPU 部署门槛
自研 XPU 的难点不仅在芯片本身,更在于构建机架级基础设施。NVLink Fusion 让 d-Matrix 直接接入英伟达的 MGX 机架架构、Spectrum-X 网络和液冷方案,省去从零搭建的环节。这有助于缩短上市时间,并降低集成高速接口、验证扩展网络等环节带来的成本和风险。
性能指标与生态伙伴
根据文章,NVLink Fusion 提供比现成以太网低 3 倍的 XPU 间延迟、高 10 倍的包速率,以及通过第六代 NVLink 实现每 XPU 3 TB/s 的全对全带宽。合作伙伴包括 d-Matrix、AWS、Arm、Intel、Fujitsu、Marvell、MediaTek、Samsung 等,覆盖芯片、IP 和光互连等领域。
对数据中心的实际意义
采用统一机架后,数据中心可以一次建设,同时支持 GPU、CPU 和 XPU,无需为每种处理器单独设计机架架构。d-Matrix 的机架还能与英伟达 GPU 系统(如 Vera Rubin NVL72)协同,实现解耦推理。这为在通用 AI 工厂内按工作负载匹配算力提供了灵活性。
Q&A
d-Matrix 采用 NVIDIA NVLink Fusion 具体要做什么?
d-Matrix 将使用 NVIDIA NVLink Fusion 将其下一代 Raptor XPU 连接到 NVIDIA 的 AI 基础设施平台,借助 NVLink 纵向扩展和 Spectrum-X 横向扩展网络、MGX 机架架构以及更广泛的 NVIDIA AI 平台,实现从定制芯片到大规模部署的加速、低风险路径。
NVLink Fusion 是什么?它解决什么问题?
NVLink Fusion 是 NVIDIA 的平台,用于将第三方定制 XPU 和 CPU 与 NVLink 纵向扩展网络、MGX 机架架构及完整 AI 工厂平台集成。它解决的核心问题是:构建定制 XPU 很难,大规模部署更难;NVLink Fusion 让 XPU 制造商跳过从零构建机架级基础设施,直接接入 NVIDIA 经过验证、全球部署的 AI 工厂平台。
NVLink Fusion 在性能上有哪些具体提升?
根据文章,NVLink Fusion 提供比现成以太网低 3 倍的 XPU 到 XPU 延迟、高 10 倍的包速率,以及通过第六代 NVLink 实现每 XPU 3 TB/s 的全对全带宽。
d-Matrix 如何将 XPU 集成到 AI 工厂中?
d-Matrix 计划使用 NVIDIA NVLink 将其 XPU 连接在单个高带宽、低延迟的纵向扩展域中。其机架还可以与 NVIDIA 基于 GPU 的系统(如 NVIDIA Vera Rubin NVL72)协同工作,用于分解式推理。d-Matrix 还计划集成 NVIDIA Vera CPU、ConnectX-9 SuperNIC、BlueField-4 DPU 和 Spectrum-X 以太网网络。
NVLink Fusion 支持哪些 CPU 架构和合作伙伴?
NVLink Fusion 支持所有主要 CPU 架构——Arm、x86 和 RISC-V,以及 NVIDIA GPU。合作伙伴包括 d-Matrix、AWS、Arm、Intel、Fujitsu、SiFive、Alchip、Astera Labs、GUC、Marvell、MediaTek、Samsung、Cadence、Synopsys、Ayar Labs 和 Lightmatter。
采用 NVLink Fusion 对 d-Matrix 和客户有什么好处?
对 d-Matrix 而言,NVLink Fusion 提供了加速、低风险的路径,使其能够利用 NVIDIA MGX 生态系统的成熟机架设计、供应链、电源和冷却基础设施,从而缩短上市时间。对客户而言,他们可以获得更快、更低风险的部署和扩展超低延迟推理的途径,并且数据中心可以一次构建,支持 GPU、CPU 和 XPU,而无需为每种处理器类型单独设计机架架构。