NVIDIA NVLink Fusion借助NVHBM定制高带宽内存实现扩展

NVIDIA NVLink Fusion借助NVHBM定制高带宽内存实现扩展

💡 原文英文,约600词,阅读约需3分钟。
📝

内容提要

NVIDIA推出NVHBM高带宽内存技术,将内存控制器集成到HBM堆栈中,提升30%带宽、降低15%功耗,并释放XPU芯片面积。亚马逊Annapurna Labs将率先合作,用于Trainium4芯片,支持NVLink Fusion架构,加速定制AI芯片开发。

🔎

延伸解读

架构创新:控制器移入HBM堆栈

NVHBM将内存控制器从XPU芯片集成到HBM基die中,改变了传统HBM架构。这一设计使XPU释放最多25%的芯片面积用于计算,同时提升30%带宽并降低15%功耗。对定制AI芯片开发者而言,这意味着在相同功耗和面积下可获得更强计算能力,或为更多计算核心腾出空间。

标准化与多供应商策略

NVIDIA计划建立标准NVHBM实现,并由多家内存供应商提供。这降低了集成和认证的工程复杂度,使NVLink Fusion客户能更快将定制AI芯片推向市场。对于超大规模云厂商和AI创新者,标准化意味着更灵活的选择和更短的开发周期,减少对单一供应商的依赖。

亚马逊率先合作,强化NVLink Fusion生态

Annapurna Labs成为NVHBM首个合作伙伴,将在Trainium4芯片中支持NVLink Fusion,使亚马逊芯片与NVIDIA GPU共享机架级架构。这延续了AWS与NVIDIA的既有合作,表明NVLink Fusion正吸引主要云厂商采用,推动定制芯片与NVIDIA平台协同工作,提升AI工作负载性能。

Q&A

什么是NVIDIA NVHBM技术?

NVHBM是NVIDIA推出的一种下一代高带宽内存技术,它将NVIDIA定制的内存控制器集成到HBM的基底芯片中,而不是放在XPU芯片上,从而提升内存性能并降低功耗。

NVHBM相比传统HBM有哪些优势?

相比标准HBM4E,NVHBM可提供高达30%的内存带宽提升、15%的HBM功耗降低,并释放XPU计算芯片上多达25%的面积。

NVHBM如何实现这些性能提升?

NVHBM将内存控制器从XPU芯片转移到HBM的3D堆叠基底芯片中,这样XPU芯片上原本用于内存控制器的面积可以用于计算,同时内存控制器与内存更近,从而提升带宽和能效。

哪家公司将率先采用NVHBM技术?

亚马逊的Annapurna Labs将成为首家与NVIDIA合作采用NVHBM技术的公司,并将其用于下一代Trainium芯片(Trainium4)中。

NVHBM与NVLink Fusion有什么关系?

NVHBM是NVIDIA NVLink Fusion架构的扩展,为定制AI芯片提供更高性能的内存,使NVLink Fusion客户能够更高效地构建半定制AI基础设施。

NVLink Fusion是什么?

NVLink Fusion是NVIDIA的机架级平台,允许合作伙伴将定制XPU和CPU连接到NVIDIA的NVLink芯片、NVLink-C2C、NVLink交换机以及MGX系统和机架,从而加速定制AI芯片的开发。

NVHBM对定制AI芯片开发有何意义?

NVHBM通过将内存控制器集成到HBM中,减少了XPU芯片的面积占用,使芯片设计者可以将更多资源用于计算核心,同时NVIDIA提供标准化的NVHBM实现,降低了多供应商集成和认证的工程难度,从而加快定制AI芯片的上市时间。

🏷️

标签

➡️

继续阅读