微软CEO纳德拉亲自下场,官宣了一个"全球第一":微软Azure,成了全球第一个把英伟达下一代AI算力平台——Vera Rubin NVL72系统——真正跑起来的云平台。几个字背后的分量,够整个行业读一宿。
你可能要问,不就又一块新芯片吗,至于吗?
先看清楚这台"新王"的底细,你再说至不至于。英伟达现在对外卖的主流,还是Blackwell那一代,厉害归厉害,但已经是"在任者"。而Vera Rubin,是坐在王座主场、虎视眈眈的下一代。它厉害在哪?只看三个数字:
一颗Rubin芯片,塞进了288GB的HBM4显存,靠8颗12层的HBM4堆叠出来,显存带宽最高能飙到每秒22TB。旁边再配上88核的Vera CPU,一碰就是一台能独自扛起大模型训练的重型机器。
比上一代Blackwell旗舰B200还要多出96GB显存。
你可能没概念——显存越大,大模型越能整个"住"进芯片里,不用动不动去外面搬运数据。对大模型来说,内存带宽就是命,288GB比192GB,不只是大了一半,是让AI训练和推理都踩上快车道,又快又省。这就是为什么微软抢着要做"第一个跑起来的",因为它已经把自己下一代AI数据中心的赌注,全押在了这台机器上。
很多时候,技术换代决定的不只是性能,是一整轮竞争的起跑线。
但我不想只停留在"参数好猛"这一层。这件事真正值得细品的,是它背后那场正在白热化的"算力军备赛"。
就在这个8月,十几天里,四家全球巨头几乎同时甩出新牌:谷歌搬出第八代TPU,英特尔端上3nm AI芯片,微软自己也在自研Maia 300加速器——全都冲着英伟达的擂台来。
而最妙的是微软的姿势。它一边是英伟达最大的客户之一,急吼吼地抢到第一批Rubin,把家底都押上去;一边又偷偷砸重金自研Maia 300,给自己留后路。这种"一边跪着买、一边偷偷造"的左右横跳,恰恰说明两件事:英伟达的生态粘性,强到连最大金主都不敢轻易翻脸;但同时,这块铁板也开始被人悄悄凿缝。
这就是我想说的第一层观点:全球AI算力,正从"一家独大"滑向"军团混战"。上一轮,英伟达靠CUDA生态和先发优势一家通吃;这一轮,换代的节奏被四大巨头同时踩下,谁先让自己的算力落地、喂饱自己的模型,谁就在下一轮卡住身位。微软抢"全球第一",抢的不只是芯片,是时间。
第二层,得拉回我们自己看。巨头烧钱换代的消息传得越响,国内算力自主的压力就越真实。当英伟达、谷歌、微软都在用"代际"速度往前冲,国产算力的窗口其实在悄悄收窄——芯片要做,HBM内存要做,封装要做,整条自主研发的链路都得赶在这一轮换代落定之前跑起来,否则差距可能不是缩小,而是被新一轮拉开。
当然,我也得泼盆冷水。纳德拉这个"全球第一",说的是"上路验证",也就是第一台真机跑通,离成百上千台满载运转还有点距离。别把一台验证机的热闹,当成产能已经爆发的信号。
但方向已经不能再清楚了——AI算力的换代战争,正式开打。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.