这周国内算力圈迎来一件值得关注的大事,国内首个全国产 10 万卡 AI 超集群曙光 8000 正式落地投入使用,接入国家超算互联网郑州核心节点,也入选了本届世界人工智能大会十大镇馆之宝。很多普通网友可能看不懂 10 万卡到底意味着什么,简单来说,就是把十万张国产加速卡整合在一起,变成一台巨型超级计算机。
过去很长一段时间,国内做大模型训练、工业仿真,很多时候高度依赖海外算力硬件。不是我们不想做,而是整套体系难度很高,不只是芯片本身,服务器硬件、高速互联网络、调度软件,每一环都要打通。曙光 8000 最大的亮点就是全链路国产化,从底层硬件到上层调度系统全部自研,实现超智融合,科学计算和 AI 智能计算可以在同一套集群上面跑,不用分开两套设备,资源利用率会高很多。
根据公开信息,集群刚投用首周就直接跑满,日均处理作业 15 万个,峰值单日能处理 50 万个任务。它支持多种精度计算,科研仿真、大模型训练、AI 推理、工业模拟都能覆盖。对科研机构来说,做气候模拟、材料研发不用排队抢算力;对企业来讲,可以在本土集群完成大模型微调,不用把数据往外输出,数据安全也更有保障。
但我们也需要客观看待这件事,全国产落地不等于已经全面超越海外顶尖集群。十万卡规模只是起点,实际使用中,软件适配、生态完善、成本控制,都是接下来要面对的现实难题。硬件跑通只是第一步,能不能让大量中小企业愿意用、用得起,才是真正的考验。
现在 AI 行业最大的瓶颈早已不只是算法,而是算力供给。海外巨头还在疯狂砸钱扩建算力,国内如果想要 AI 产业健康发展,不能一直依靠外部供应链。曙光 8000 落地,代表国内已经具备建设大规模国产算力集群的完整工程能力。
未来两三年,国内还会陆续上线更多国产智算中心。希望不止是堆硬件规模,配套软件工具、开发者生态同步跟上,让高校、中小企业都可以便捷使用国产算力。国产算力建设不是一次技术宣告,而是一场长期马拉松,这次投用,算是非常扎实的一步。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.