📝AI行业

AMD Helios 机架级 AI 系统亮相:AI 基础设施竞争从 GPU 单卡走向整柜协同

作者:AI测评网编辑部·2026-07-24·浏览 2

AMD 推进 Helios 机架级 AI 基础设施路线图,围绕 Instinct GPU、EPYC CPU、Pensando 网络与开放机架标准构建整柜方案。它折射出 AI 算力竞争的新阶段:不再只比单颗芯片,而是比内存、网络、能耗、交付和生态协同。

AMD Helios 机架级 AI 系统亮相:AI 基础设施竞争从 GPU 单卡走向整柜协同
阅读提示当前文章有1052字,阅读完大概需要3分钟。

背景:AI 算力竞争正在从“买 GPU”变成“买整套基础设施”

2026 年 7 月 23 日,TechCrunch 报道 AMD 在 Advancing AI 活动上重点展示 Helios 机架级 AI 系统,并称该方案面向全球最大 AI 实验室与云数据中心的训练、推理需求。与此同时,AMD 官方 Helios 页面把它定位为面向前沿 AI 和主权计算的开放、可扩展机架级基础设施。

这类产品的意义不只是“AMD 又发布了一块更强的 GPU”。当模型训练和大规模推理进入万卡、十万卡时代,真正决定成本和稳定性的因素变成整柜架构:GPU、CPU、网络、内存、液冷、电源、运维和软件栈必须一起工作。AI 算力从零部件采购,转向了云厂商和模型公司更关心的系统级交付。

关键变化:Helios 把开放标准放在卖点中心

AMD 官方资料显示,Helios 参考设计集成 72 颗 AMD Instinct MI455X GPU,并搭配 AMD EPYC “Venice” CPU、AMD Pensando Vulcano AI NIC 等组件;它采用 OCP Open Rack Wide、UALink、Ultra Ethernet Consortium 等开放标准,强调更大的 HBM4 内存容量、更高带宽以及面向多 Agent 工作流的大上下文承载能力。

官方页面还提到,Helios 方案面向 2026 年下半年规模部署。TechCrunch 则报道,AMD 将 Helios 与一批客户和伙伴放在同一叙事里,包括 Microsoft、OpenAI、Meta、Oracle、Anthropic 等正在规划或部署相关系统的 AI 与云基础设施玩家。

这说明机架级 AI 的竞争重点已经变成“谁能让大客户放心扩容”。单卡性能仍然重要,但客户更关心整柜网络是否稳定、液冷与供电是否可运维、软件生态是否成熟、交付节奏是否可控,以及是否能降低对单一供应商的依赖。

影响:Nvidia 的优势会被系统生态而非单点指标挑战

Nvidia 仍然是 AI 数据中心市场最强势的玩家,优势不仅来自 GPU,也来自 CUDA、网络、整机、云伙伴和开发者生态。AMD Helios 的信号在于,它试图用开放标准和整柜方案争夺“第二供应链”的位置,让大型 AI 公司在下一轮扩容中拥有更多选择。

The Verge 对 AMD 与 Anthropic 合作的报道显示,AI 公司正在通过算力合作、股权投资和长期部署计划绑定基础设施供应商。对于模型公司来说,多供应商策略可以缓解供给风险和成本压力;对于芯片公司来说,拿到头部模型客户的真实工作负载,才有机会补齐软件栈和规模化部署经验。

对国内读者而言,这件事也说明主权 AI、行业大模型和企业私有化部署不会只拼“有没有 GPU”。当算力集群越来越像电力、网络和冷却工程的综合项目,数据中心建设、网络设备、存储、散热、运维自动化和模型推理优化都会成为 AI 产业链中的关键环节。

适合哪些人关注

这件事适合云计算厂商、AI 基础设施团队、模型创业公司、IDC 和液冷厂商、芯片投资人、企业 IT 架构师以及关注国产算力生态的人关注。对采购方来说,未来评估 AI 算力不应只看显卡型号,而要比较每 token 成本、集群利用率、软件兼容、供货周期和故障恢复能力。

接下来值得观察三个指标:Helios 在 2026 年下半年的真实出货和部署规模;ROCm 与主流训练、推理框架的兼容体验;以及 Microsoft、Anthropic 等头部客户是否会公开更多生产环境反馈。如果这些指标成立,AI 基础设施市场会从单一巨头主导,逐步转向更开放但也更复杂的多生态竞争。

来源参考