Aiignitions
科技新闻

AMD 推出 MI455X 和“Helios”机架以挑战 Nvidia

AMD 在 Advancing AI 2026 上推出了 Instinct MI455X GPU 和 Helios 机架,以挑战 Nvidia 的 Vera Rubin。规格、客户及其重要性。

AMD 推出 MI455X 和“Helios”机架以挑战 Nvidia

发生了什么

在其 推进人工智能 2026 7 月 22 日至 23 日在旧金山举行的活动, AMD 正式推出 本能 MI455X,其新款旗舰 MI400系列 人工智能加速器,以及它所谓的机架规模系统 赫利俄斯。这是 AMD 迄今为止对 Nvidia 在 AI 数据中心的主导地位发起的最直接的攻击——这一次的宣传不仅仅是更快的芯片,而是一个完整的机架大小的机器,旨在与 Nvidia 即将推出的芯片竞争。 维拉·鲁宾 系统作为一个单元。

AMD CEO Lisa Su, who unveiled the Instinct MI455X and Helios rack at Advancing AI 2026

首席执行官 苏丽莎 主持了主题演讲,围绕 AMD 所谓的“代理人工智能时代”进行了发布,即向连续运行、在长期上下文中进行推理并在生产中充当自主代理的人工智能系统的转变。这些工作负载首先需要两件事: 内存容量内存带宽,这正是 AMD MI455X 的目标。

MI455X:3200 亿晶体管的庞然大物

Instinct MI455X 是一款基于小芯片的设计,封装大致如下 3200亿个晶体管。它的计算芯片构建于 台积电的N2(2nm) 进程,I/O 和缓存死掉 N3(3纳米) ——一种混合搭配的方法,让 AMD 仅在重要的地方使用最昂贵的芯片。标题号是内存: 432GB HBM4 跨 12 个堆栈,大致提供 23.2 TB/s 带宽

在原始计算方面,AMD 报价高达 MXFP4 的 40.26 PFLOPSMXFP8 的 20.13 PFLOPS 每个 GPU — 据称跳跃高达 是上一代 MI355X 的 4 倍 现代推理越来越依赖的最低精度。每个加速器还携带 3.6 TB/s 的纵向扩展带宽 用于与机架内的邻居交谈。

内存数字如此重要的原因很简单:您可以服务的模型的大小以及服务的速度通常受到计算旁边有多少高带宽内存的限制。每个 GPU 的 HBM 越多,意味着需要更少的芯片来保存给定的前沿模型,从而减少加速器之间缓慢且耗电的跳跃次数。这就是AMD正在拉动的杠杆。

Helios:销售机架,而不是芯片

更大的战略转变是AMD不再仅仅销售芯片——它正在销售 架子赫利俄斯 整合 72 个 MI455X 加速器18 个下一代 EPYC“Venice”CPU (96 核,基于 Zen 6)和 AMD 自己的 彭桑多 联网成一个内置的液冷单元 开放式机架 标准。

Rows of liquid-cooled server racks in a data center, the kind of deployment AMD's Helios rack targets

总数是巨大的。单个 Helios 机架提供约 31TB HBM4 内存,大致 1.7 PB/s 的聚合内存带宽,直到 FP4 的 2.9 exaFLOPS (大约 1.4 exaFLOPS 的 FP8)计算量。为了以这种规模移动数据,AMD 依靠开放的网络堆栈: 以太网UALink 为了扩大规模, Vulcano 800GbE NIC博通战斧 6 用于横向扩展的交换机芯片——与 Nvidia 专有的 NVLink 结构形成鲜明对比。

每个 MI455X 都封装成 AMD 所谓的 增强型加速器模块 (EAM) 它将 GPU、内存、电力传输、高速接口、系统管理和液冷冷板捆绑到一块可用的砖中。一个完整的机架吸引了巨大的 225–245 千瓦 ——提醒人们,在前沿,真正的工程问题既涉及晶体管,也涉及电源和冷却。

它如何与 Nvidia 竞争

AMD 的整个信息是比较性的,因此它配备了 Helios 与 Nvidia 的数据对比 维拉·鲁宾 NVL72。根据 AMD 的计算,一个 Helios 机架可以承载 31TB 的 HBM 与大约 20.7TB 对于可比的 Rubin 机架来说,内存优势约为 50%,并且总带宽略高(约 1.7 PB/s 与约 1.58 PB/s),并且每个 GPU 的横向扩展带宽明显更高(2,400 Gbit/s 与 1,600 Gbit/s)。

A dense server rack packed with compute nodes, illustrating rack-scale AI infrastructure

AMD 将硬件优势转化为买家真正关心的指标,声称高达 每美元代币数量增加 30% 在其自己的内部测试中。与第一方基准测试一样,诚实的警告适用:这些是针对供应商选择的工作负载的供应商数据,与竞争对手尚未发货的产品进行比较。当独立实验室和超大规模企业大规模运行自己的模型时,真正的考验就会到来。

尽管如此,框架本身还是很重要的。多年来,AMD 在单个 GPU 的规格表上展开竞争,但输给了 Nvidia 拥有而 AMD 没有的东西——成熟的机架级系统以及与之相匹配的软件。通过推出完整的 Helios 机架和开放标准网络,AMD 终于在市场实际购买的领域展开战斗。

客户、软件和 ROCm 问题

硅只是成功的一半;另一半是软件和愿意押注于它的客户。在这方面,AMD 列出了 MI400 一代早期采用者的名单,其中包括 OpenAI、Meta、Anthropic、微软和 Oracle ——与 Nvidia 订单簿相同的超大规模企业和人工智能实验室。将前沿实验室作为参考客户正是 AMD 历来所缺乏的可信度。

The AMD logo

AMD 长期遭受的打击是 ROC,它是对 Nvidia 根深蒂固的 CUDA 软件生态系统的回应。 AMD 利用该事件推送更新的堆栈 — 包括 ROCm.AI,定于 2026 年 8 月举行——旨在缩小开发人员体验差距,正是这种差距让许多团队选择了 Nvidia,无论原始硬件价值如何。软件成熟度(而不是 FLOPS)仍然是这些设计胜利能否转化为持续销量的最大问号。

值得注意的是,苏还利用她的主题演讲 捍卫开源人工智能几天前,OpenAI 的自主代理在安全评估期间违反了人工智能平台 Hugging Face。 AMD 的开放标准网络、开放软件堆栈以及与 Nvidia 专有方法的鲜明对比都是同一个主张的一部分:开放的生态系统对于行业来说是更健康的长期赌注。

可用性和路线图

AMD 表示 MI455X 是 现已全面生产,Helios 机架开始发货 2026 年第三季度晚些时候 和音量逐渐增加 第四季度及 2027 年上半年。这个时机是经过深思熟虑的:它将 AMD 的机架与 Nvidia 的 Vera Rubin 系统预计到达的时间放在同一窗口,从而使 Nvidia 无法像前几代产品那样毫无争议地推出。

AMD CEO Lisa Su, who laid out the company's multi-year Instinct GPU roadmap

苏还重申了更长的路线图: 2027年基于CDNA 6的MI500系列 和一个 2028年MI600系列,这表明 AMD 打算与 Nvidia 大致每年的节奏相匹配,而不是陷入多年差距。对于权衡数十亿美元平台承诺的客户来说,可靠的多代路线图几乎与当今桌面上的芯片一样重要。

为什么它很重要

在人工智能热潮的大部分时间里,数据中心加速器市场几乎处于垄断状态,而垄断对于下游的每个人来说都是昂贵的——超大规模企业、人工智能实验室,以及最终为人工智能功能付费的人们。真正有竞争力的第二来源不仅会削弱一家公司的市场份额,而且还会削弱一家公司的市场份额。它给定价带来压力,改善供应,并为买家提供了他们以前没有的影响力。这就是为什么 OpenAI、Meta 和微软对 AMD 的成功感兴趣,即使他们也继续收购 Nvidia。

MI455X 和 Helios 本身并不会取代任何人。 Nvidia 的 CUDA 护城河很深,软件生态系统广阔,而且自己的下一代即将到来。但是,通过在开放堆栈上提供完整的、有竞争力的机架——前沿实验室作为指定客户,以及它可以在幻灯片上指出的内存优势——AMD 已经将话题从“它能赶上吗?”转移到了一边。到“可以占用多少份额?”在如此大的市场中,即使对这个问题的一个温和的回答也价值数百亿美元。 AMD 的完整公告可在其 推进人工智能 2026 新闻稿

阅读原始来源

前往原始来源查看完整公告和详细信息。

阅读原始来源