我之前就说过无数次,华为绝对会被中国科技史记住至少一千年,今天我还是敢拍着胸脯把这话再说一遍。
这么多年美国在芯片领域卡我们的脖子,所有人都看在眼里。
之前几乎所有人都觉得,AI算力这条赛道,我们肯定要被英伟达死死压着打,结果谁也没料到,华为直接换了个思路弯道超车,而且超的还是英伟达最引以为傲的核心赛道。
今天就跟大家好好聊聊华为刚放出来的这款重磅产品——昇腾950 AI算力芯片。
![]()
这颗芯片从一开始就是专门为AI场景设计的,不像英伟达的显卡最早是为游戏做的,跑AI其实算是“兼职”。
昇腾950分PR和DT两个型号,核心功能几乎没什么差别,它最厉害的地方根本不是单卡性能,而是华为自研的独门超节点技术。
大家都清楚,受外部技术限制影响,我们目前能量产的最高工艺是7纳米,而且良品率还不算高,美国那边早就摸到3纳米以下的门槛了。
单卡的差距明摆着:昇腾950的算力,只有英伟达去年H200的四分之一,和今年刚出的旗舰B200比,更是只有对方的六分之一。
说直白点,人家一张卡,就能顶我们六张。
![]()
既然单卡拼工艺我们暂时拼不过,那怎么办?
华为直接走了条没人想到的路:把8192张昇腾950芯片全部整合到一起,攒出了Atlas 950 SuperPod真机。
可能有人会说,这不就是堆卡吗?堆硬件谁不会啊?
你这想法可太简单了。
几千张卡堆在一起不难,难的是让它们真的做到1+1等于2,甚至大于2。
普通的堆卡方案,卡和卡之间数据传输慢、延迟高,还容易丢包,最后就算堆上一万张卡,实际跑出来的算力可能还不如几百张卡组成的集群。
![]()
华为直接拿出了自己独家研发的零区2.0协议,软件硬件全是自主研发,从通信协议到光模块全部打通适配。
最后做到了什么效果?8192张卡协同工作,对外表现得就像一整张完整的超级芯片。
你知道英伟达同类技术现在做到什么程度了吗?
他们的NVLink 576,最多只能把576张卡拼成一个协同整体,而且这项技术要等到2027年年底才能正式落地。
华为现在已经实现的8192卡规模,是英伟达规划上限的14倍。
给大家算一笔最直观的账:我们单卡算力是英伟达的六分之一,可集群的卡数量是对方的14倍,最后算下来,这套集群的总算力直接能达到英伟达规划中旗舰集群的80多倍。
官方公开的数据更有说服力:华为这套集群的算力达到8 EFlops,英伟达2027年才能做出来的同类型集群算力才5 EFlops,华为直接比对方高出60%。
带宽的差距更夸张,华为做到了16.3,英伟达只有1.5,差了十倍还多。
延迟更是远远甩开对方:华为的单跳时延只有200纳秒,英伟达是1000纳秒,性能直接是对方的五倍。
之前在上海世界人工智能大会的开幕式上,这套设备就已经公开亮相,央视也专门做了报道。
美国之前的算盘打得特别清楚:互联网时代他们攥着根服务器,就等于攥住了全球互联网的核心命脉。
到了AI时代,他们本来想靠着英伟达的算力垄断,把AI时代的核心命脉也死死攥在自己手里。
结果华为这一手,直接把他们的美梦给打碎了。
你单卡性能强又怎么样?我们靠着自己的底层核心技术,把近万张卡拧成一股劲,照样能实现反超。
这哪里是什么简单的堆卡战术,这分明就是刻在中国人骨子里的变通智慧啊。
现在AI算力这条赛道,美国方面再也没法一家独大了,华为直接站出来,和英伟达形成了分庭抗礼的局面。
以前总有人说,我们在高科技领域被人卡了脖子就没辙了,现在华为用实打实的成绩告诉所有人:路从来都不止一条,你堵死我一条,我就能走出十条新的路来。
就想问大家一句,这波华为,牛不牛?
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.