72颗GPU、31TB显存,AMD Helios押注机架级AI

2026年07月24日 由 ATYUN编辑部 发表 894 0
两名数据中心工程师在开放的液冷AI机架前检查计算与网络设备
工程师在数据中心检查一套液冷机架级AI计算系统(原创配图)

AI芯片的竞争正在从单颗GPU扩展到整座机架。AMD 7月23日正式推出Helios机架级系统:一台机架整合72颗MI455X GPU、18颗第六代EPYC“Venice”处理器、31TB HBM4和高速网络,面向大模型训练与推理。AMD称,它在特定Kimi K2 Thinking负载下,每美元生成的令牌最多比NVIDIA Vera Rubin NVL72高30%;真正的悬念不只是参数能否领先,而是这套开放架构能否按期交付并形成稳定的软件体验。

三点看懂:AMD把竞争单位从GPU变成整机架

第一,Helios不是单卡产品。计算、CPU、HBM4、机架内互连、横向网络和ROCm软件被共同设计,目标是减少大规模集群里的系统瓶颈。

第二,内存和互连是主要卖点。单机架提供31TB HBM4、每秒1.7PB内存带宽,并通过开放以太网体系连接更多机架。

第三,首批客户决定成色。OpenAI计划从2026年第四季度开始上线Helios;Anthropic的首个吉瓦级部署预计2027年上半年启动,量产表现仍待验证。

72颗MI455X如何组成一台“AI工厂”

Helios采用18个四GPU计算托盘,共计72颗MI455X,并搭配18颗第六代EPYC处理器。单机架峰值能力为2.9 exaflops FP4和1.4 exaflops FP8。这里的关键不是把更多芯片堆在一起,而是让CPU持续喂饱GPU,让模型参数和KV缓存尽量留在高速内存中,再通过低延迟互连把训练或推理任务分配到整个机架。

MI455X属于MI400系列。AMD称其令牌吞吐量可达到MI355X的34倍,但这项数据基于DeepSeek V4 Flash、FP4精度以及高、中、低交互点的内部测量,不能直接外推到所有模型。Helios还使用Pensando网络,把机架内的UALink over Ethernet与面向集群扩展的标准以太网结合,试图用开放协议降低专有互连带来的锁定。

软件层是这套硬件能否落地的另一半。AMD同步推出ROCm.ai,让Claude、Codex和Cursor等编码智能体理解ROCm与AMD平台,辅助编写、优化和部署GPU代码。PyTorch、Hugging Face、vLLM和SGLang已完成MI455X适配。对开发团队而言,这比单纯提高峰值算力更实际:如果迁移、调优和排错仍需要大量专门工程师,硬件价格优势很容易被软件成本抵消。

30%令牌成本优势,必须连同测试条件一起读

AMD给出的对比很醒目:相较Vera Rubin NVL72,Helios峰值FP4性能高15%,HBM容量高50%,HBM带宽高6%,横向扩展带宽高50%,每美元令牌最多高30%。但这些数字并非统一的第三方实测。性能与内存对比主要来自AMD实验室计算和建模,成本指标则采用Kimi K2 Thinking、3.2万输入与8000输出令牌,并结合系统GPU的小时价格预测。

这意味着结果对模型结构、批处理、并发、上下文长度、供电、散热、软件版本和实际采购价都非常敏感。对云厂商或大型AI实验室,更有意义的指标还包括机架持续利用率、集群故障恢复、跨机通信损耗、每瓦令牌数和运维人力。AMD已经把比较推进到完整系统层面,但还没有替客户完成真实生产环境中的总拥有成本核算。

从Q4上线到吉瓦部署,交付节奏才是下一场考试

AMD称Helios已进入生产阶段,OpenAI预计2026年第四季度开始上线,2027年加速部署;Anthropic计划采用最多2吉瓦的MI450系列算力,首个吉瓦从2027年上半年启动。Meta、Microsoft、Oracle等也在验证或采用相关平台。大客户名单说明需求存在,但“计划”“验证”和“投入生产”代表不同成熟度,不能把未来容量提前写成已交付收入。

对行业而言,Helios把NVIDIA主导的AI基础设施竞争拉到了机架级:芯片厂商必须同时证明GPU、CPU、网络、软件和供应链协同能力。开放以太网和ROCm给客户更多选择,也带来更多组合和调优责任。对中小团队,这类系统不会直接降低购买门槛,但若云服务商真正获得更低的每令牌成本,最终可能反映到推理价格和可用容量上。

ATYUN编辑判断:Helios最值得关注的不是“单卡击败谁”,而是AMD终于拿出一套可以按机架采购、按集群扩展的完整答案。31TB HBM4和开放网络为超大模型提供了清晰卖点,ROCm.ai则直指长期软件短板。现在仍应把30%的成本优势视为有明确条件的厂商估算;真正的胜负,要看2026年末上线后的稳定利用率、第三方基准和2027年吉瓦级部署能否如期兑现。

文章来源:AI Agent
欢迎关注ATYUN官方公众号
商务合作及内容投稿请联系邮箱:bd@atyun.com
评论 登录
热门职位
Maluuba
20000~40000/月
Cisco
25000~30000/月 深圳市
PilotAILabs
30000~60000/年 深圳市
写评论取消
回复取消