今年「超节点」有多火
你自己来逛逛WAIC就知道了
![]()
路过各大展位的时候
超节点是气场拉满、最吸引眼球的
![]()
那么问题来了
超节点VS普通集群到底啥区别?
我们先拿【一个机柜】为单位讲
1个普通服务器机柜
是把很多台服务器塞进一个柜子
常见的,塞8台八卡GPU服务器
好比一栋楼里住8户人家,每户8口人
一家人沟通不串门,但跟别家就要串门
![]()
1个超节点
整个机柜被设计成一台完整的超级服务器
里面也放64张GPU
却相当于一个超级大平层
只住1个大户人家,64口人
所有人沟通不用串门,直接面对面交流
![]()
所以,超节点从设计之初
就是按大平层思路,而不是单元楼
GPU/NPU加速卡 + CPU + 高速互联交换芯片 + 大容量内存 + 网络设备 + 液冷系统 + 供电系统
按一整套协同系统来规划设计
如果上升到【以集群为单位】
多个超节点可以通过Scale up方式组网
形成一个更大的跨楼大平层
![]()
超节点更适合扛AI大活
一家人齐芯协力,效率拉满
这也是当下国产超节点火爆的原因
接下来就有人要问了
国产超节点哪家强?
这款超节点必然占据一席
它就是↓
百度天池256卡超节点
震撼亮相WAIC,让我们一睹真容
![]()
![]()
接下来如果你继续追问
这天池256超节点,到底强在哪儿?
我可以用一句话来概括
⬇️
强在全国产化
从芯片到协议到软件到整机
每一层都做到全栈自研
第一强是自研国产芯
天池256卡超节点
由256张昆仑芯全互联而成
![]()
昆仑芯,来头可不小
基于自研XPU-P架构
![]()
第二强是算力调度平台
光有强悍的算力芯还不够
一个超大规模的AI集群
如何调用和激发几万颗芯的潜能?
靠的是百舸AI计算平台
好比芯片算力调度指挥中心
![]()
昆仑芯 +百舸,软硬协同
把芯片、网络、调度和框架彻底打通
构成了一套完整AI Infra
万卡集群跑起来,稳得一匹
![]()
第三强是整体架构设计
围绕计算、网络、内存、存储、散热
重新设计了一套超级精密的架构
整机架构、全链路全自研
![]()
①计算:构建纯国产异构算力池
过去,国产芯片最大难题,是怎么协同作战
![]()
天池256支持CPU+GPU+DPU异构协同
把不同国产芯片纳入一个算力资源池
![]()
对于用户而言
自由选择芯片品牌,灵活搭配
尤其推理和智能体业务爆发的时代
更加需要GPU和CPU异构计算
![]()
天池256还兼容X86生态
极大降低迁移成本
已有业务,无需大改造
就可以轻松跑起来
![]()
tips:智能体大爆发时代,CPU深度参与控制、调度、集群管理和智能体运行,软件迁移是否平滑,直接影响AI集群落地效率。
②网络:全链路自研高速互联
超节点的高速互联是全国产化难点
一整套高速链路器件,国产化难度极高
![]()
![]()
百度选择了自己干,全链路自研
自研XPU-Link 互联协议
互联协议是超节点的灵魂
百度从零写起,一行行代码
写出了中国芯自己的通信语言
![]()
通过自研XPU-Link互联协议
构建国内首个可编程的Scale-Up通信网络
网络时延低到2μs,带宽有效率高达77%
能对标国际顶尖方案
![]()
自研Scale-up互联架构
这相当于超节点的AI高速路网
路(架构)不行,256卡就是一盘散沙
天池256采用最新自研HPN5.0架构
达到业界顶流水准
![]()
自研超高带宽交换机
从交换架构设计到软件协议栈
只为大模型通信做专属优化
![]()
自研国内首个Cable Tray铜缆互连
高速互连物理链路
是国产化里最难啃的骨头之一
天池超节点,成功拿下
![]()
这套自研高速互联组合拳下来
超节点实现了超高带宽、超低时延
端到端时延优化50%,做到亚秒级响应
用户体感:飙车!
![]()
③能耗散热:自研国产化液冷CDU
这是国内首个 Side-Car CDU
整机柜全液冷设计,PUE降低至1.15
![]()
![]()
④存储:内存四层+存储加速架构设计
百度通过四级内存体系
缓解内存墙问题
![]()
通过近存计算+存内计算
让大规模数据处理速度更快
![]()
再回头看看
天池256是一款深度国产化的产品
计算、网络、存储、散热、软件五大系统
以及整体结构设计
均实现了深度国产化
![]()
当然,这还不是最难的
全栈国产化超节点的最大难度
是让所有国产部件
在一个系统里高效协同,性能不打折
![]()
但这件事,天池256做到了
百度为了干成最强国产超节点
也是拼了
![]()
每一个短板,都自己补齐
每一个难题,都自己突破
最终我们看到的是
一台真正协同工作的AI超级服务器
一台效率超级高的智算怪兽
![]()
天池256卡超节点今年6月正式上市
已完成主流模型的适配
在性能测试上,更是优秀
吞吐性能、推理效率、端到端时延
都得到了前所未有的提升
![]()
当然,更难得是
大量实战验证
![]()
①百度自身核心业务的验证
百度用全国产昆仑芯集群完成了
大模型文心5.1重要版本的训练
![]()
2025年至今,短短1年时间
已交付多个昆仑芯万卡集群
从万卡到三万卡,投入生产
![]()
而且这些万卡级的集群
有效训练率达97%
硬件不空转,利用率拉满
![]()
②来自头部客户的认可
来看一组公开的中标信息吧
足已证明一切
部分中标项目
- ①招商银行AI芯片资源项目,昆仑芯支持银行核心业务场景落地大模型;
- ②南方电网AI算力服务器项目,2.3亿元;
- ③中国移动AI通用计算设备集采,超10亿元;
- ④中国联通济南大模型创新工场项目,8.37亿元;
- ⑤中国联通济南智算一体机项目,2.9亿元;
![]()
⬇️
WAIC逛了这两天,最大的感受是
超节点很热,国产化需求更热
当超节点真正开始落地
用户开始寻找能用、好用的国产超节点时
百度天池超节点,给了市场更优的选择
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.