来源:市场资讯
(来源:Ai&芯片那点事儿)
2026世界人工智能大会(WAIC)上海世博展览馆H2馆B116展位,一套超大规模算力系统真机陈列吸引了大量专业观众驻足。这套获评大会官方“镇馆之宝”的十万卡AI超集群——曙光8000(登峰),完成了全球首次公开亮相。
![]()
与往年展会中常见的算力“纸面发布”不同,这是一套已正式上线运营并交出首份成绩单的真实系统。
上线即满载:十万卡算力并非“建而无用”
7月9日,曙光8000正式上线。一周后的运营数据显示:首周即实现满载运行,日均处理作业数突破15万个,单日处理作业峰值超过50万个。
截至目前,系统已完成近千项超智融合应用适配,覆盖大模型训练、高通量推理、科学计算等多个万卡级规模场景。上线后快速满载,反映出科研机构、企业和开发者对超大规模、高质量算力的现实需求正在加速释放,也表明十万卡级算力已开始持续承接更加广泛的科研和产业任务。
在百万级用户并发请求的高负载状态下,系统仍可保持运行畅通。依托智能调度引擎、数据亲和性算法和多元融合调度策略等动态资源管理机制,系统能够根据任务类型、数据位置和资源状态进行智能分流和按需调配,实现“高负载不拥堵、多任务不排队”。
系统工程全面协同:从芯片到散热全链路打通
十万卡规模稳定运行,考验的不是单一性能,而是整个系统的协同能力。这套十万卡集群围绕“芯片、计算、存储、网络、散热、应用、服务”全链路展开设计。
在核心芯片层面,整套集群搭载6款国产自研核心芯片,覆盖通用处理器、AI加速芯片、互连交换芯片等关键环节,整体性能对标国际头部产品。
在算力密度上,系统采用全球首创的高密度机柜结构,单个计算单元算力密度较其他超节点提升20倍。通过超高速正交架构、全电互连、浸没相变液冷、高效供电等系统工程技术,在有限空间内实现业内顶尖的算力集成度。
在网络互联上,自研scaleFabric类IB原生RDMA高速互连技术,无需依赖光通讯即可实现十万卡规模超高速稳定互连。单子网支持11.4万卡规模,网卡端到端时延低于1微秒,交换机转发时延仅260纳秒,单端口800G,毫秒级链路故障自愈。
在存储上,配套ParaStor分布式存储系统已获2026年IO500榜单生产型全节点、10节点两项全球性能第一。系统可随集群节点扩容实现存储能力同步增长。
在散热与供电上,浸没式相变液冷技术可承载单机柜MW级功率密度,全年自然冷却,数据中心PUE低至1.04,系统可用性高达99.99%。
从科研到产业:算力正在转化为生产力
算力的价值最终要落实到应用。曙光8000已完成300余项重点应用深度优化,其中65项适配半机规模、20项适配整机规模、15项达到戈登贝尔奖量级超大规模仿真标准,覆盖20余个主流科研、工业赛道。
在科研前沿,8万卡算力完成蛋白质折叠全流程模拟;9万卡算力实现3.16万亿原子DFT高精度仿真;8.8万卡算力完成328万亿网格湍流直接模拟,支撑航空、船舶、工业流体研发。
在产业一线,系统已全面接入智谱GLM-5、阿里Qwen3.5等国产主流大模型。OneScience科学大模型一站式开发平台以自然语言驱动科学研究全流程,已为20多家重点科研单位提供支持。
![]()
作为超算互联网核心节点,该系统还推出了三大生态共建计划——十万卡共创者激励计划、智能体生态共创与招募计划、核心生态伙伴招募计划——面向高校科研团队、科创企业、AI开发者、产业链上下游厂商开放合作权益。
从“建得成”到“用得好”
首周满载、近千项应用适配、高负载状态下稳定运行——这套十万卡AI超集群用数据证明,超大规模AI基础设施的评价重点正在由系统规模转向实际服务能力。
从万卡到十万卡,从“建得成”到“用得好、服务广、可复制”,十万卡级AI超集群已不再只是技术概念的验证,而已成为可落地、可运营的系统级解决方案,为AI for Science和产业智能化升级提供坚实的算力底座。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.