← 文章 / 行业与公司动态
NVIDIA 博客 2小时前 · 2026-09-13 01:26:46 · 3 阅读

d-Matrix 采用 NVIDIA NVLink Fusion 实现机架级 XPU 部署

AI 推理芯片制造商 d-Matrix 今日宣布将采用 NVLink Fusion 将其下一代 Raptor XPU 连接到 NVIDIA 的 AI 基础设施平台——成为越来越多基于 NVIDIA AI 平台构建的合作伙伴之一。

通过连接 Raptor 与 NVIDIA NVLink 纵向扩展、Spectrum-X 横向扩展网络、NVIDIA MGX 机架架构以及更广泛的 NVIDIA AI 平台,NVLink Fusion 为 d-Matrix 提供了一条从定制硅片到大规模部署的加速且风险更低的路径。

“推理需求正在激增,但资金、时间和能源仍然是有限的,”d-Matrix 联合创始人兼首席执行官 Sid Sheth 在昨日的媒体简报会上表示。“借助 NVLink Fusion 和 MGX,我们可以将 Raptor XPU 整合到广泛部署的液冷架构中,为客户部署和扩展超低延迟推理提供更快、风险更低的路径。”

NVIDIA AI 平台纵向集成、横向开放。NVLink Fusion 将这种开放性扩展到 XPU 和 CPU,让芯片公司可以专注于处理器创新,同时利用 NVIDIA 基础设施在 AI 工厂规模上进行部署。

从定制硅片到机架级部署

构建 XPU 只是第一步。在 AI 工厂规模部署它需要一个涵盖网络、机架架构、电源、冷却、软件及成熟供应链的完整平台。每个步骤——芯片采购、高速接口集成、纵向扩展网络方案验证、机架架构设计与认证——都会增加时间、成本和风险。

NVLink Fusion 让硅片创新者可以直接接入 NVIDIA 经过验证的平台。它是将定制 XPU 和 CPU 连接到 NVIDIA 技术栈的高带宽、低延迟技术。

通过采用 NVLink Fusion,d-Matrix 可以利用 NVIDIA MGX 生态系统成熟且经过验证的机架设计、供应链、电源及冷却基础设施。通过标准化采用通用机架,数据中心可以一次性构建,并支持 GPU、CPU 和 XPU——无需为每种处理器类型设计单独的机架架构。

NVLink Fusion 将 d-Matrix XPU 整合至 AI 工厂

d-Matrix 计划借助 NVIDIA NVLink 将其 XPU 连接成单一高带宽、低延迟的 scale-up 域。其机架还可以与 NVIDIA Vera Rubin NVL72 等 NVIDIA GPU 系统协同工作,实现解耦式推理。

d-Matrix 还计划集成 NVIDIA Vera CPU、NVIDIA ConnectX-9 SuperNIC、NVIDIA BlueField-4 DPU 以及 NVIDIA Spectrum-X 以太网网络。配合 NVLink 和 MGX,这些技术为 d-Matrix 提供了经过验证的基础,使其能够在灵活统一的 AI 工厂中,将专用推理系统与 NVIDIA 系统协同部署。

NVLink Fusion 向专用 XPU 架构开放 NVIDIA AI 工厂

NVIDIA 全栈 AI 工厂平台包括 NVIDIA Vera Rubin NVL72、Groq 3 LPX、Vera CPU 机架、Vera BlueField-4 STX 存储和 Spectrum-6 SPX 以太网网络。该平台具备完全的可互换性,能够运行各类 AI 工作负载、模型及模型架构,同时实现最优的每瓦性能和最低的每 token 成本。

NVLink Fusion 让客户能够在统一的 AI 工厂平台内灵活地为不同工作负载匹配合适的算力,并获得 NVIDIA 的网络、系统、软件和全球供应链资源。d-Matrix 这类芯片创新企业可以借助 NVLink Fusion 提升性能、加快上市速度,并降低部署半定制 AI 工厂的风险。

原始来源: NVIDIA 博客

评论 (0)