d-Matrix 采用 NVIDIA NVLink Fusion 进行机架级 XPU 部署

d-Matrix 将采用 NVLink Fusion 将其新一代 Raptor XPU 连接到 NVIDIA 的 AI 基础设施平台,加入持续增长的 NVIDIA 机架级扩展架构合作伙伴生态系统,以加快产品上市时间。
作者

AI 推理芯片制造商 d-Matrix 宣布,将使用 NVIDIA NVLink Fusion 将其新一代 Raptor XPU 接入 NVIDIA 的 AI 基础设施平台,成为 NVIDIA 不断壮大的生态系统合作伙伴中的一员。

通过将 Raptor 接入 NVIDIA NVLink 纵向扩展和 Spectrum-X 横向扩展网络、NVIDIA MGX 整机柜架构和更广泛的 NVIDIA AI 平台,NVLink Fusion 为 d-Matrix 打造了一条从定制芯片到大规模部署的加速且低风险的路径。

d-Matrix 联合创始人兼首席执行官 Sid Sheth 表示:“对推理的需求正在急剧增长,但资金、时间和能源却是有限的。借助 NVLink Fusion 和 MGX,我们能够将 Raptor XPU 集成到广泛部署的液冷架构中,支持客户更快、更低风险地部署和扩展超低延迟推理。”

NVIDIA AI 平台是纵向整合且横向开放的平台。NVLink Fusion 将这种开放性扩展到 XPU 和 CPU,使芯片公司能够专注于处理器创新,同时依托 NVIDIA 基础设施实现大规模 AI 工厂部署。

从定制芯片到整机柜部署

构建 XPU 仅是第一步。要部署大规模 AI 工厂,需要一套涵盖网络、整机柜架构、供电、冷却、软件以及经过验证供应链的完整平台。采购芯片、集成高速互连、验证纵向扩展网络解决方案、设计并认证整机柜架构,每个步骤都会增加时间、成本和风险。

NVLink Fusion 助力芯片创新者直接采用 NVIDIA 经过验证的平台。这种高带宽、低延迟的技术,可将定制 XPU 和 CPU 连接到 NVIDIA 堆栈。

通过采用 NVLink Fusion,d-Matrix 可以利用 NVIDIA MGX 生态系统成熟且经过验证的机架设计、供应链、供电和冷却基础设施。基于通用机架实现标准化,数据中心只需一次建设,即可支持 GPU、CPU 和 XPU,而无需为每种处理器类型配备单独的机柜架构。

NVLink Fusion 将 d-Matrix XPU 集成至 AI 工厂

借助 NVIDIA NVLink,d-Matrix 计划将其 XPU 连接到一个高带宽、低延迟的纵向扩展域。机架还可以与 NVIDIA Vera Rubin 系统协同运行,以支持分离推理。

d-Matrix 还计划集成 NVIDIA Vera CPU、NVIDIA ConnectX-9 SuperNIC、NVIDIA BlueField-4 DPU 和 NVIDIA Spectrum-X 以太网网络。这些技术与 NVLink 和 MGX 相结合,为 d-Matrix 提供了一个成熟的基础架构,使其能够在灵活、统一的 AI 工厂中与 NVIDIA 系统协同部署专用推理。

NVLink Fusion 向专用 XPU 架构开放 NVIDIA AI 工厂

NVIDIA 全栈 AI 工厂平台包括 NVIDIA Vera Rubin 系统、Groq 3 LPX、Vera CPU 机架、Vera BlueField-4 STX 存储以及 Spectrum-6 SPX 以太网网络,具有完全的可互换性,能够运行各种 AI 工作负载、模型和模型架构,并且具有出色的每瓦特性能和最低的每 Token 成本。

NVLink Fusion 使客户能够在统一的 AI 工厂平台中,灵活地将适宜的算力与每项工作负载相匹配,开放接入 NVIDIA 网络、系统、软件和全球供应链。d-Matrix 等芯片创新厂商可借助 NVLink Fusion 提升性能、加快上市时间,并降低部署半定制 AI 工厂的风险。