← 文章 / 芯片硬件
NVIDIA 博客 4小时前 · 2026-08-31 18:41:01 · 2 阅读

NVIDIA 扩展 NVLink Fusion,引入 NVHBM 定制高带宽内存

AI 的下一波发展正对基础设施提出全新要求。

随着 AI 智能体和万亿参数工作负载逐渐成为主流,AI 基础设施的性能不再只取决于算力,还取决于如何将计算、内存、存储、网络和软件统筹设计成一个统一系统。

为了帮助超大规模云服务商和 AI 创新者打造新一代半定制 AI 基础设施,NVIDIA 今天宣布扩展 NVIDIA NVLink Fusion,引入 NVIDIA NVHBM。这是一项新一代高带宽内存技术,可为 XPU 带来更高的内存性能和能效。该技术将由领先的内存合作伙伴进行验证并提供,从而让 NVLink Fusion 客户也能采用这一先进内存方案。

传统 HBM 架构会将内存控制器置于 XPU 芯片上,占用原本可用于计算的宝贵硅面积。NVHBM 基于 NVIDIA 未来 GPU 将采用的同款技术,将 NVIDIA 定制内存控制器集成到 HBM 基础裸片中。

NVHBM 不再将内存控制器置于 XPU,而是把它集成到 3D HBM 堆叠中。与标准 HBM4E 相比,NVHBM 可将内存带宽提升最高 30%,将 HBM 功耗降低 15%,并为 XPU 计算裸片释放最多 25% 的芯片面积。

NVIDIA 正在建立标准化的 NVHBM 实现方案,并通过多家内存供应商提供。这样一来,跨供应商集成和验证内存所需的工程工作量将显著减少,NVLink Fusion 客户也能更快将定制 AI 芯片推向市场。

Amazon 的 Annapurna Labs 将成为首家参与 NVHBM 开发的企业,这是其与 NVIDIA 围绕 NVLink Fusion 展开更广泛合作的一部分。

AWS 与 NVIDIA 继续推进 NVLink Fusion 合作

Amazon 的 Annapurna Labs 将与 NVIDIA 合作开发 NVHBM 技术和 NVLink 扩展架构,以提升 AI 工作负载的性能与能效。

这进一步拓展了 AWS 此前宣布的 NVLink Fusion 支持。Annapurna Labs 将从 Trainium4 开始,在下一代 Trainium 芯片中支持 NVLink Fusion,让 Amazon 芯片与 NVIDIA GPU 能够基于统一的机架级架构协同工作。

Amazon Annapurna Labs 副总裁 Nafea Bshara 表示:“NVHBM 代表了一种全新的架构路径,旨在提升高带宽内存的性能与能效。我们期待通过这项技术合作,为未来 AWS 基础设施的设计带来助益。” 

垂直整合,横向开放

NVLink Fusion 支持合作伙伴将定制 XPU 和 CPU 接入 NVIDIA 的机架级平台。

合作伙伴可以使用 NVIDIA NVLink chiplet、NVLink-C2C、NVLink Switch,以及 NVIDIA MGX 系统和机架;同时还能接入由 CPU 合作伙伴、ASIC 设计商、系统制造商和技术供应商组成的广泛生态。 

NVLink Fusion 随 NVIDIA 每一代机架级系统架构一同推出,使超大规模云服务商和 AI 原生企业能够将工程资源集中于 XPU 创新,同时采用经过验证的技术栈,完成扩展互联与跨节点互联、机架级系统及软件部署,从而以更快的速度、更低的风险推出半定制 AI 基础设施。

详细了解 NVLinkNVLink Fusion

原始来源: NVIDIA 博客

评论 (0)