未在直播

报道

AMD Helios单机架容纳72块GPU,四家超大规模云服务商表示支持

随着AMD推出基于开放标准、挑战英伟达在前沿AI领域主导地位的产品,微软加入Meta、OpenAI和甲骨文的行列。

译自英文原文。

原语言视频

文字实录 · 正在加载

这里值得细细体会的数字是六万四千八百。按照AMD希望你理解的方式来计算,一套完整的Helios部署可以容纳这么多块GPU:九十个机架,每个机架七十二个加速器,作为一台机器连接在一起,每个机架配备三十一太字节的HBM4,整个集群共有一百四十四颗AMD EPYC "Venice" CPU 47。2026年7月20日星期一,AMD正式发布了这台机器,并将微软加入其客户名单,此前名单中已有Meta、OpenAI和甲骨文,这让前沿AI机架领域在英伟达之外真正出现了第二个名字 256。

这一转变在数量上虽小,在性质上却很大。迄今为止,最大的AI训练和推理集群几乎全部运行在英伟达平台上。Helios是AMD的一次尝试,试图向超大规模云服务商出售他们一直迫切需要的东西:用于训练最大模型的机架的可靠第二供应来源,并配有一套无需费力谈判才能获得的软件栈 469。

Helios机架里到底有什么

Helios不是一颗芯片,而是一个完整的技术栈:AMD Instinct MI455X GPU负责计算,EPYC "Venice" CPU负责调度编排,Pensando网卡负责网络互联,ROCm则是将这一切连接起来的软件 79。公布的规格正如AMD所需要的那样激进。每个机架配备七十二个MI455X加速器、三十一太字节HBM4内存、2.9 exaflops的FP4推理性能和1.4 exaflops的FP8训练吞吐量 4。一篇行业文章估计,当AMD将其作为单一系统介绍时,整台机器约为九十个机架 47。

该系统推出时间比英伟达发布其下一代Vera Rubin机架晚约四个月,而Helios正是为与该产品竞争而打造的 9。Helios本身最早于2025年6月公布,比周一的客户揭晓早了一年多 7。

谁已签约,何时出货

早期客户名单是最大看点。微软于同日表示,将在Azure中部署Helios机架,与Meta、OpenAI和甲骨文一道成为主力买家 25611。这意味着全球最大的三个云平台,再加上现存最耗算力的模型集群之一的运营方,在同一个上午公开承诺采用非英伟达机架。

至于时间安排,各信息来源勾勒出分两步推进的节奏。据一家媒体报道,工程样品预计于2026年下半年推出,随后于2027年第二季度量产 24。各报道中日期差异不大,这反映的是产品仍然很新,而非说法相互矛盾;读者应将2026年视为试点之年,将2027年视为放量之年。

Helios不是一款更快的GPU。它是AMD的主张:超大规模云服务商应当采购的单位是机架本身,而不是其中的芯片。

开放机架为何对云采购方至关重要

AMD对微软、Meta、甲骨文和OpenAI的推销不仅在于性能,更在于架构。AMD将Helios定位为英伟达专有的NVL72、Grace Blackwell和Vera Rubin系列的开放标准替代方案,这意味着该机架采用公开接口和AMD的ROCm软件,而不是客户必须通过授权才能进入的封闭生态系统 469。对于每年在AI基础设施上花费数百亿美元的超大规模云服务商而言,这一区别并非表面文章;它决定了走的是一条只有单一供应商的路,还是一条有出口的路。

反方观点在这里同样重要。英伟达的护城河既在于芯片,也在于软件,CUDA积累了数十年的模型和内核工作,ROCm目前尚无法与之匹敌。一个基于开放标准交付的机架,仍然必须以客户期望的吞吐量、用他们已经熟悉的开发工具,运行客户所关心的模型。

信息来源未能回答的关键问题

发布会报道对客户名单和纸面规格信心十足,但对将决定Helios是否重要的那些数字却只字未提。发布会相关讨论中广泛流传的若干数字,包括AMD为该项目配置的团队规模、每机架价格、每机架功耗、每机架CPU数量以及AMD自己的营收预测,均未出现在本文所依据的信息来源中。本文将其视为未经证实的信息。

已知

  • AMD于2026年7月20日正式发布Helios。 2
  • 微软将在Azure中部署Helios机架。 5
  • Meta、OpenAI和甲骨文也被列为早期客户。 2
  • 每个机架容纳72块MI455X GPU和31 TB HBM4,FP4推理性能为2.9 exaflops,FP8训练性能为1.4 exaflops。 4

未知

  • 每机架价格、功耗、每机架CPU数量、项目人员规模以及AMD自己的营收预测。
  • 在真实前沿模型训练中比较Helios与英伟达Vera Rubin的独立基准测试。

后续

  • 微软、Meta、OpenAI和甲骨文能否在2027年从发布公告转向批量订单。
  • 在超大规模云服务商实际运行的工作负载上,ROCm与CUDA相比表现如何。

为何重要

来源

追溯本篇报道的依据。图谱展示其关联;下方链接可打开本文引用的来源。

来源图谱将在您阅读时加载。

引用来源

  1. AMD Launches Helios, Its First AI Rack System to Rival Nvidia — Microsoft, Meta, OpenAI Signed OnHeyDay News · 视频
  2. AMD Helios: Microsoft signs on to rack AI system that rivals Nvidiawww.cnbc.com
  3. AAI 2026: AMD Launches AMD Helios Rackscale Solution for Frontier AI - AMD Newsroomnewsroom.amd.com
  4. AMD’s Helios puts 72 GPUs and 31 terabytes of HBM4 in one rack. It is AMD’s answer to Nvidia’s NVL72.thenextweb.com
  5. Microsoft to deploy AMD Helios AI system on Azureqz.com
  6. AMD launches Helios, its first rack AI system to rival Nvidia, adding Microsoft as newest buyer – Business Insiderwww.bizinsider.org
  7. AMD officially launches Helios rackscale system, with MI455X GPUs, Venice Epyc CPUs, and Pensando - DCDwww.datacenterdynamics.com
  8. Helios marks AMD's biggest AI infrastructure push yet | Network Worldwww.networkworld.com
  9. AMD Fires Back at Nvidia with Helios AI System, Epyc CPUswww.datacenterknowledge.com
  10. AMD's Helios rack is finally shipping, and it's coming for Nvidia's AI dominance | TechSpotwww.techspot.com
  11. Microsoft Taps AMD For At Scale AI CPU And GPU Clusterswww.nextplatform.com

译文更新于 2026年9月24日 GMT-5 09:15

修订记录

  1. r1首次发布。