报道
AMD Helios单机架容纳72块GPU,四家超大规模云服务商表示支持
随着AMD推出基于开放标准、挑战英伟达在前沿AI领域主导地位的产品,微软加入Meta、OpenAI和甲骨文的行列。
译自英文原文。
原语言视频
文字实录 · 正在加载
这里值得细细体会的数字是六万四千八百。按照AMD希望你理解的方式来计算,一套完整的Helios部署可以容纳这么多块GPU:九十个机架,每个机架七十二个加速器,作为一台机器连接在一起,每个机架配备三十一太字节的HBM4,整个集群共有一百四十四颗AMD EPYC "Venice" CPU 47。2026年7月20日星期一,AMD正式发布了这台机器,并将微软加入其客户名单,此前名单中已有Meta、OpenAI和甲骨文,这让前沿AI机架领域在英伟达之外真正出现了第二个名字 256。
这一转变在数量上虽小,在性质上却很大。迄今为止,最大的AI训练和推理集群几乎全部运行在英伟达平台上。Helios是AMD的一次尝试,试图向超大规模云服务商出售他们一直迫切需要的东西:用于训练最大模型的机架的可靠第二供应来源,并配有一套无需费力谈判才能获得的软件栈 469。
Helios机架里到底有什么
Helios不是一颗芯片,而是一个完整的技术栈:AMD Instinct MI455X GPU负责计算,EPYC "Venice" CPU负责调度编排,Pensando网卡负责网络互联,ROCm则是将这一切连接起来的软件 79。公布的规格正如AMD所需要的那样激进。每个机架配备七十二个MI455X加速器、三十一太字节HBM4内存、2.9 exaflops的FP4推理性能和1.4 exaflops的FP8训练吞吐量 4。一篇行业文章估计,当AMD将其作为单一系统介绍时,整台机器约为九十个机架 47。
谁已签约,何时出货
早期客户名单是最大看点。微软于同日表示,将在Azure中部署Helios机架,与Meta、OpenAI和甲骨文一道成为主力买家 25611。这意味着全球最大的三个云平台,再加上现存最耗算力的模型集群之一的运营方,在同一个上午公开承诺采用非英伟达机架。
至于时间安排,各信息来源勾勒出分两步推进的节奏。据一家媒体报道,工程样品预计于2026年下半年推出,随后于2027年第二季度量产 24。各报道中日期差异不大,这反映的是产品仍然很新,而非说法相互矛盾;读者应将2026年视为试点之年,将2027年视为放量之年。
Helios不是一款更快的GPU。它是AMD的主张:超大规模云服务商应当采购的单位是机架本身,而不是其中的芯片。
开放机架为何对云采购方至关重要
AMD对微软、Meta、甲骨文和OpenAI的推销不仅在于性能,更在于架构。AMD将Helios定位为英伟达专有的NVL72、Grace Blackwell和Vera Rubin系列的开放标准替代方案,这意味着该机架采用公开接口和AMD的ROCm软件,而不是客户必须通过授权才能进入的封闭生态系统 469。对于每年在AI基础设施上花费数百亿美元的超大规模云服务商而言,这一区别并非表面文章;它决定了走的是一条只有单一供应商的路,还是一条有出口的路。
反方观点在这里同样重要。英伟达的护城河既在于芯片,也在于软件,CUDA积累了数十年的模型和内核工作,ROCm目前尚无法与之匹敌。一个基于开放标准交付的机架,仍然必须以客户期望的吞吐量、用他们已经熟悉的开发工具,运行客户所关心的模型。
信息来源未能回答的关键问题
发布会报道对客户名单和纸面规格信心十足,但对将决定Helios是否重要的那些数字却只字未提。发布会相关讨论中广泛流传的若干数字,包括AMD为该项目配置的团队规模、每机架价格、每机架功耗、每机架CPU数量以及AMD自己的营收预测,均未出现在本文所依据的信息来源中。本文将其视为未经证实的信息。
已知
未知
- 每机架价格、功耗、每机架CPU数量、项目人员规模以及AMD自己的营收预测。
- 在真实前沿模型训练中比较Helios与英伟达Vera Rubin的独立基准测试。
后续
- 微软、Meta、OpenAI和甲骨文能否在2027年从发布公告转向批量订单。
- 在超大规模云服务商实际运行的工作负载上,ROCm与CUDA相比表现如何。
为何重要
来源
追溯本篇报道的依据。图谱展示其关联;下方链接可打开本文引用的来源。
来源图谱将在您阅读时加载。
引用来源
- AMD Launches Helios, Its First AI Rack System to Rival Nvidia — Microsoft, Meta, OpenAI Signed On
- AMD Helios: Microsoft signs on to rack AI system that rivals Nvidia
- AAI 2026: AMD Launches AMD Helios Rackscale Solution for Frontier AI - AMD Newsroom
- AMD’s Helios puts 72 GPUs and 31 terabytes of HBM4 in one rack. It is AMD’s answer to Nvidia’s NVL72.
- Microsoft to deploy AMD Helios AI system on Azure
- AMD launches Helios, its first rack AI system to rival Nvidia, adding Microsoft as newest buyer – Business Insider
- AMD officially launches Helios rackscale system, with MI455X GPUs, Venice Epyc CPUs, and Pensando - DCD
- Helios marks AMD's biggest AI infrastructure push yet | Network World
- AMD Fires Back at Nvidia with Helios AI System, Epyc CPUs
- AMD's Helios rack is finally shipping, and it's coming for Nvidia's AI dominance | TechSpot
- Microsoft Taps AMD For At Scale AI CPU And GPU Clusters
译文更新于 2026年9月24日 GMT-5 09:15
修订记录
- r1首次发布。