人工智能

AI 推理芯片公司 d-Matrix 加入英伟达 NVLink Fusion,下一代 XPU 将接入 MGX 机架生态

2026年9月11日 · admin
OpenMagic API

据 IT之家 9 月 10 日消息,AI 推理芯片制造商 d-Matrix 于美国加州当地时间 10 日宣布加入 NVIDIA(英伟达)NVLink Fusion 生态系统。按照来源信息,d-Matrix 面向机架级部署的 XPU 系统将采用 NVIDIA MGX 通用机架参考架构,其自“Raptor”起的下一代推理 XPU 将与 NVIDIA Vera CPU、NVLink 交换机、BlueField-4 DPU、ConnectX-9 SuperNIC 以及 Spectrum-X 以太网网络进行整合,以支持纵向扩展与横向扩展。这意味着,d-Matrix 将把自身 AI 推理芯片更深地接入英伟达的数据中心互联与机架基础设施体系。

从单颗芯片走向机架级系统,d-Matrix 选择接入成熟生态

d-Matrix 的核心业务聚焦 AI 推理 XPU。相比训练场景,推理侧更强调吞吐、延迟、能耗与部署密度,尤其在大模型应用持续落地后,企业级推理基础设施正在从“单卡性能”竞争转向系统级效率竞争。来源显示,d-Matrix 机架级 XPU 系统将采用 NVIDIA MGX 通用机架参考架构,这一选择的重点不只是硬件外形或机柜设计,而是让其产品能够更快嵌入数据中心现有的计算、网络和管理体系。

具体来看,d-Matrix 自“Raptor”起的下一代推理 XPU 将与多项 NVIDIA 数据中心组件整合,包括 Vera CPU、NVLink 交换机、BlueField-4 DPU、ConnectX-9 SuperNIC 和 Spectrum-X 以太网网络。这一组合覆盖 CPU、芯片间互联、DPU、网卡和以太网网络,指向的是更完整的 AI 集群基础设施,而不是单一加速卡的简单适配。

  • 纵向扩展(Scale-up):通过高速互联在机架或节点内部提升多加速器协同能力。
  • 横向扩展(Scale-out):通过网络能力支持更多节点组成更大规模集群。
  • 模块化部署:基于 MGX 平台的 d-Matrix 机架将采用模块化无线缆托盘,降低系统集成复杂度。
  • 生态协作:另一家 NVLink Fusion 合作伙伴将为 d-Matrix XPU 提供定制连接解决方案。

NVLink Fusion 的价值:让非英伟达 XPU 更容易进入 AI 数据中心

NVLink Fusion 的一个重要产业意义,在于把 NVIDIA 长期积累的高速互联与数据中心系统能力开放给更多定制处理器和加速器伙伴。对于 d-Matrix 这样的 AI XPU 企业而言,加入该生态后,可以在较少自行设计整套机架级方案的情况下,借助 NVIDIA 的参考架构与互联组件获得更大的扩展域。

来源摘要也指出,加入 NVLink Fusion 生态意味着 d-Matrix 无需进行复杂的选型设计,即可享受到机架级解决方案带来的扩展能力,从而把更多精力放在 AI XPU 本身的开发上。对芯片创业公司或专用加速器厂商来说,这一点很关键:AI 基础设施市场的竞争门槛已经不只是芯片算力,还包括软件栈、互联、散热、供电、网络与运维适配等全链路能力。

影响解读:AI 推理硬件竞争正在转向“生态位”竞争

过去几年,AI 加速器厂商往往强调单芯片指标,例如算力、能效或片上内存架构。但在大模型推理进入生产环境后,客户更关心的是能否以可控成本持续扩展,能否与现有数据中心网络、CPU、DPU 和管理平台协同。d-Matrix 加入 NVLink Fusion,反映出专用推理芯片厂商正在主动寻找更强的系统级入口。

对英伟达而言,NVLink Fusion 生态也有助于扩大其数据中心互联与机架架构的影响力。即使部分计算单元来自第三方 XPU,围绕 NVLink、MGX、BlueField、ConnectX 与 Spectrum-X 的基础设施仍可能成为集群构建的关键底座。换言之,英伟达不仅在 GPU 市场拥有优势,也在尝试将其互联和系统架构变成更广泛 AI 硬件生态的共同接口。

对中文科技产业观察者来说,这一事件值得关注的并非某一家芯片公司的单点合作,而是 AI 推理基础设施的演进方向:未来的数据中心可能会出现更多面向特定负载优化的 XPU,但这些 XPU 要真正规模化落地,仍需要接入成熟的机架、网络与互联生态。d-Matrix 此次加入 NVLink Fusion,正是这一趋势的一个新案例。