目前业界规模最大的超节点产品——华为昇腾950超节点(Atlas 950 SuperPoD)真机,近日在2026世界人工智能大会现场首次公开展出,展出的版本搭载16台计算柜、共计1024张昇腾卡。
超节点正在成为AI算力基础设施的主流形态。它的技术逻辑并不复杂:传统做法以八卡服务器为基本节点,通过横向堆叠组成集群。而超节点,则试图扩大纵向扩展的范围,让更多芯片通过高带宽、低时延的方式连接,像一台计算机那样协同工作。
昇腾950超节点正是沿此路径设计——基于灵衢互联协议,以单柜64卡为基本单元,最大可扩展至8192卡高速互联。
在性能参数上,昇腾950超节点提供1 EFLOPS FP8、2 EFLOPS FP4算力,拥有256TB全局统一内存编址空间。TB级NPU互联超大带宽与3μs超低RTT时延,是其突破集群内通信瓶颈的关键指标。
在满配状态下,昇腾950超节点由128个计算柜和32个互联柜组成,共计160个机柜,占地面积约1000平方米,搭载8192颗昇腾950DT芯片,计划于2026年第四季度上市。
“超大带宽、超低时延、统一内存编址”被华为列为三大核心技术优势。其中,统一内存编址的实现依赖灵衢互联协议——它让所有计算卡可直接互通内存资源,无需繁琐的数据搬运与链路等待。
这一设计对承载超长文本上下文尤为关键,可规避长对话中的“记忆断层”问题。而实现这一切的技术底座,正是灵衢互联协议——它已于2025年向业界开放,所有厂商均可基于其规范和参考架构打造算力基础设施。
华为首次披露384规模已累计商用超过750套。该产品已应用于互联网、运营商、金融、教育、医疗、交通、制造等20多个行业。华为称其为国内唯一训练出SOTA模型的超节点。
一个值得关注的行业信号是:国产算力的衡量标准正在从单颗芯片的峰值性能,转向一整套系统能够调动多少有效算力。华泰证券将2026年称为“国产超节点元年”,据其测算,2028年中国超节点架构市场规模有望达到3414亿元,2026至2028年复合年均增长率为194%。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.