微软 Azure 将引入 AMD Helios 机架级 AI 平台,面向推理与 HPC 扩容
据 IT之家 7 月 20 日消息,微软宣布将与 AMD 进一步扩展 Azure 的 AI 与高性能计算(HPC)基础设施,在云端引入 AMD 最新的 Helios AI 平台以及下一代 EPYC 数据中心处理器。微软称,随着 AI 工作负载规模快速增长,单一类型的基础设施已难以覆盖不同场景需求,因此 Azure 正通过更多芯片与系统方案扩充计算集群。此次合作将直接支撑三款即将推出的 Azure 服务,其中包括面向 AI 推理的 ND MI455X v7 虚拟机。
Azure 新服务覆盖数据处理、EDA 与 AI 推理
来源显示,微软此次引入的 AMD 底层技术将服务于三类云端实例:HDv2 虚拟机、HXv2 虚拟机以及 ND MI455X v7 虚拟机。三者分别面向数据处理、电子设计自动化(EDA)和 AI 推理工作负载,说明 Azure 并非只把新平台用于大模型训练,而是试图覆盖更广泛的高性能计算与 AI 应用环节。
其中,ND MI455X v7 的重点在于 AI 推理。随着大模型应用进入企业办公、搜索、代码生成、智能客服和多模态应用等场景,推理侧的算力消耗正在持续上升。相比训练任务,推理更强调单位成本、延迟、吞吐和稳定供给,这也是云厂商不断引入不同加速器平台的重要原因。
- HDv2 虚拟机:主要用于数据处理相关工作负载。
- HXv2 虚拟机:面向电子设计自动化(EDA)等 HPC 场景。
- ND MI455X v7 虚拟机:用于 AI 推理工作负载,基于 AMD 新一代 AI 加速能力。
AMD Helios 代表机架级 AI 系统竞争升级
延伸信息显示,AMD Helios 是 AMD 首个机架级 AI 平台,于 2026 年 6 月在台北国际电脑展上首次公开展示,计划于 2026 年内供货。其核心配置包括第 6 代 EPYC Venice 处理器与 Instinct MI455X 加速器。来源提到,该平台可搭载最多 256 核 EPYC Venice 处理器,并集成 72 颗 Instinct MI455X 加速器,总计配备 31TB HBM4 显存,理论 FP4 稠密精度算力可达 2900 PFLOPS。
这一配置体现出 AI 基础设施正在从“单卡性能”竞争转向整机架系统能力竞争。对于大模型服务商和云平台来说,网络互连、内存带宽、机架功耗、系统散热以及软件栈适配,都会影响最终可用算力。AMD 以 Helios 这样的机架级方案进入 Azure,有助于提升其在云端 AI 基础设施市场的存在感。
影响解读:云厂商正在降低对单一路线的依赖
微软此前已经推出自研云端 AI 芯片 Azure Maia 100,并计划在数据中心部署;同时,微软也宣布扩大与 AMD 等芯片厂商的合作,在 Azure 中加入 AMD MI300X 加速虚拟机处理 AI 工作负载。此次继续引入 Helios 与下一代 EPYC,表明微软在 AI 基础设施上采取的是多供应商、多架构并行路线。
这种策略的现实意义在于,AI 云服务需求增长迅速,企业用户对训练、推理、HPC、EDA、数据分析等任务的性能与成本要求并不相同。通过引入更多硬件平台,Azure 可以在不同价格、不同性能特征和不同工作负载之间提供更细分的选择。对中文开发者和企业用户而言,未来选择云端 AI 服务时,也需要更加关注实例背后的加速器架构、显存容量、推理吞吐与软件生态,而不仅是“是否支持大模型”。
总体来看,微软与 AMD 的合作扩展意味着 AI 云基础设施进入更高密度、更系统化的阶段。随着 Helios 这类机架级平台落地 Azure,AI 推理服务的供给能力、HPC 工作负载的云端迁移,以及芯片厂商在云市场中的竞争格局,都将迎来新的变化。