微软和AMD今天联手放出了一枚重磅消息:微软将把AMD的下一代Helios机架级AI加速器“大规模”引入自家数据中心和Azure云基础设施。不过,这份声明里唯独少了一个市场最想知道的数字——这笔交易到底有多大。
AI计算需求的胃口已经大到填不满。开源社区最近放出的前沿模型Kimi K3,任何人都能拿来做微调和部署,进一步推高了市场对算力的渴求。在这样的大背景下,微软和AMD此次合作的目标很明确:给雷德蒙德在内部和外部场景都补上AI浮点运算的弹药。双方宣布,微软承诺批量采购AMD Helios系统,用来在自己数据中心运行前沿模型负载,同时也会以Azure AI基础设施的形式提供给客户和服务。
![]()
这意味着,无论是想要训练和推理AI模型的实验室,还是通过Microsoft Foundry部署AI工作负载的企业,都可以在Azure上用到新一代的AMD算力。Helios的投入,让AMD在从Nvidia手里抢数据中心GPU份额的战役中又多了一张王牌。过去一年,AMD已经先后和OpenAI、Meta敲定了涉及吉瓦级计算规模、潜在金额数百亿美元的超大合作。
简单回顾一下Helios的规格。这套机架级加速器将在今年晚些时候与Nvidia的Vera Rubin NVL72系统正面交锋。一个Helios机架内部通过高速互联串起了72颗下一代Instinct MI455X GPU,整个系统拥有高达31.1TB的HBM4内存总容量。在AI模型常用的OCP数据类型下,这些GPU可以输出1.4 exaFLOPS的FP8算力,切换到FP4则直接飙到2.9 exaFLOPS。
互连带宽方面的对位也很有意思。AMD把机架内的纵向扩展带宽定在260 TB/s,与Nvidia Vera Rubin NVL72持平;而横向扩展带宽则做到43 TB/s,比Vera Rubin宣称的水平高出一倍左右,靠的是基于以太网的UALink技术。当然,这条链路在实际运行中表现如何,还有待验证。
除了AI加速器这颗重磅炸弹,两份公告里还夹带了一批Azure的CPU和数据处理更新。Azure即将新增两个基于AMD第六代Epyc Venice CPU的虚拟机系列,分别是面向“智能体AI和数据管道”的HDv2系列,以及专为半导体设计工作流打造的HXv2系列。同时,微软还会把已经部署的AMD Pensando DPU整合进Azure Boost服务,用来加速网络和存储操作。
Tom’s Hardware已经抵达AMD本周举行的Advancing AI活动现场,关于AMD在下半年以及更长远的AI路线图,我们在现场会带来第一手报道。对这次合作更详细的技术拆解和竞争格局分析,也可以在后续的内容中持续关注。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.