![]()
观点网讯:在WAIC 2026期间,紫光股份旗下新华三集团重点展示了灵犀智算解决方案。该方案依托“算-网-存-云-安-维”全栈协同能力,覆盖Token从建设、运行、治理到调优的全生命周期,旨在通过系统级优化破解大模型时代算力成本高企的难题。
在建设阶段,灵犀智算方案采用一体化交付模式,规避多厂商兼容与联调周期,支持标准化批量开局和逐层弹性扩容,从单集群平滑拓展至万卡乃至十万卡跨域规模,兼容中心智算、边缘算力、混合云三类部署形态,企业现有异构GPU可统一接入复用,中小型项目AI业务可做到天级上线。在运行阶段,方案配备全链路自治运行体系,硬件异常3秒感知、分钟级隔离自愈,网络闪断仅小幅降速不中断业务,有效训练时长稳定在99%,保障Token不间断产出。通过全栈软硬件的深度协同优化,灵犀智算方案已实现Token生成全链路TCO下降30%以上、能耗成本降低40%以上。
在基础设施层面,液冷散热系统液冷占比可达80%,PUE降至1.04以下。UniPoD S80000系列超节点可实现单计算节点内部署1颗CPU+4张AI加速卡,单柜支撑上百千瓦高功率部署。网络方面,业界首发单芯片102.4T智算交换机,支持64×1.6T高密端口;广域无损传输实现1500公里级延时低于1ms,支撑2000公里长距离算力协同。
存储与推理加速同样关键。X20836全闪实现18盘位/U,单节点带宽200GB/s、300万IOPS。XCache推理加速系统将首Token延迟TTFT降低90%、用户并发数提升10倍。
在调优层面,训练调优后集群最高算力有效利用率达82%+,推理整体性能实现2倍以上提升,千卡规模集群扩展比达91%。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.