近日,上海世博展览馆H2馆,两台巨型算力设备不约而同走向台前。
其中,华为昇腾950超节点完成真机首秀,成了本届WAIC的“流量担当”;再有中国首个全国产十万卡AI超集群曙光8000,上线一周后满载归来并成为大会镇馆之宝,现场接受产业各界的近距离审视。
一个是刚刚掀起盖头备受瞩目的“新人”,另一个是已接网投运为全国用户提供服务的“实干家”。这次WAIC搭台,恰好将中国AI算力产业的两个关键阶段并置在了一起——从规模竞速到系统交付,共同组成国产大算力故事的上下篇章。
昇腾950:千卡级超节点首秀,万卡上市进入“倒计时”
昇腾950超节点的真机亮相,无疑是本届WAIC算力展区最吸睛的流量点之一。
![]()
据悉,这款超节点搭载昇腾950芯片,采用自研“灵衢”互联协议,以单柜64卡为基本单元,现场展出的1024卡版本由16台计算柜组成,可实现业界最大规模的内存统一编址,像一台计算机一样协同工作。
华为方面的技术参数也确实亮眼:单柜64卡,FP8算力达64 PFLOPS,1024卡总算力达1 EFLOPS;采用全液冷设计,面向万亿参数大模型的高效训练与推理。
值得注意的是,根据华为去年9月全联接大会上公布的时间表:搭载昇腾950DT芯片的Atlas 950 SuperPoD,要等到2026年第四季度才能正式上市。此前有消息称,首批上市版本将是1024卡规格,8192卡满配版还需视市场需求跟进。
简单来说,千卡真机已落地,万卡级算力在路上。尽管这轮规模竞速并未延续其“遥遥领先”的姿态,但考虑到昇腾芯片近年来的销量增长,超节点产品未来市场空间非常值得期待。
曙光8000:十万卡超集群落成,跑出行业“加速度”
昇腾系万卡还在等待上市,曙光8000却上演了一波弯道超车。
就在WAIC开幕前一周,中国首个全国产十万卡AI超集群曙光8000(登峰)已正式落成,并同步接入国家超算互联网。集群采用“超智融合”技术路线,实现全类型计算的原生一体化融合,支持FP64到INT8全精度,可覆盖科学计算、大模型训推、工业仿真等多类场景。
在系统建设上,曙光8000围绕“芯片、计算、存储、网络、散热、应用、服务”全链路自研:海光等国产芯片提供底层支撑;scaleFabric类IB原生RDMA高速网络实现十万卡高可靠连接;ParaStor分布式存储斩获2026全球IO500双榜第一;浸没式相变液冷技术让PUE低至1.04。
中科曙光高级副总裁李斌在接受采访时坦言,“从万卡到十万卡确实有很多挑战,不是简单乘10倍”。最大的难点来自规模扩大后对性能和可靠性的指数级考验。而曙光8000用了半年时间完成从3万卡试运行到10万卡完整投运的全流程,验证了系统级工程的成熟度。
![]()
应用为王:集群跑得快,更要跑得满
大规模算力集群的终极命题,不是“建得成”,而是“用得好、跑得满”。
据公开信息,昇腾950作为国产AI算力的核心底座,已广泛落地于云端大模型、政企数字化、工业制造、车载端侧及边缘计算等多个核心赛道,应用场景正在快速铺开。
曙光8000接入国家超算互联网后,更已完成300余项超智融合应用优化,超过70个应用实现万卡规模扩展,涵盖大模型、机器人、创新药、新材料、量子计算、天文气象等二十余个领域。
应用成果也非常显著。在真实科研任务中,曙光8000已支撑蛋白质折叠模拟、万亿原子级水分子动力学模拟、百万亿网格湍流模拟等世界级成果。在产业层面,该集群与中国头部大模型企业,成功完成了最新大语言模型在万卡级的完整预训练工作。
有业内人士认为,昇腾950和曙光8000在WAIC同台亮相,一个代表了垂直一体化路线在超节点层面的极致探索,一个则展示了开放式超智融合路线在十万卡规模上的工程落地。
国产算力的比拼,正在从“谁的产品参数更亮眼”,转向“谁的系统能更快跑起来、跑出价值”。在这条赛道上,十万卡不是终点线,新一轮系统化比拼将进一步聚焦AI应用层需求。
故事仍在继续。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.