随着大模型训练与推理对算力规模、互联效率的要求不断攀升,处于IPO阶段的AIoT企业特斯联升级发布T-Cluster 512超节点架构,并于近期正式推出其核心软件底座——ThiCP异构算力调度平台V1.0。前者以512张AI加速卡高速互联、柜间总带宽超25.6 TB/s的高密度设计,为千亿乃至万亿参数大模型训推提供系统性算力支撑;后者通过VCU虚拟算力单元实现异构资源精细切分与弹性调度,将算力利用率提升至70%以上,直击行业算力整卡独占、闲置率高的长期痛点,为“Token即服务”(TaaS)商业模式落地筑牢技术根基。
![]()
业内普遍判断,以更低成本实现高带宽互联、高密度封装与高能效系统,正成为人工智能纵深发展的下一阶段方向。在此背景下,特斯联在IPO阶段重磅推出T-Cluster系列产品。作为面向千亿乃至万亿参数大模型训练与推理设计的智算集群,T-Cluster 512凭借高算力密度设计显著提升训练效率,可覆盖从中小规模模型训练到超大规模参数迭代的全场景智算任务。
系统设计层面,T-Cluster 512采用分层级算力配置,以GPU、NPU等高密度集成计算单元为核心,通过Scale-up与Scale-out网络协同优化,破解传统分布式计算在异构兼容、通信瓶颈与资源碎片化方面的难题。集群集成多种高速互联技术,构建专属通信域,支持512张AI加速卡超高速互联,互联带宽较此前提升8倍以上,柜间互联总带宽超过25.6 TB/s。
作为T-Cluster 512超节点的核心组件,ThiCP(Terminus Hybrid Intelligent Computing Platform,特斯联混合智算平台)承担异构算力管理、调度与混合训推的关键职能。平台通过软硬件协同设计与系统级优化,构建起算力资源标准化、资源池化、异构融合、多维度智能调度相结合的全栈能力,着力解决混合智算场景中资源浪费与利用率偏低的难题。其算力调度引擎基于容器技术实现算力管理与调度,以轻量化、高兼容、可扩展的优势打破算力壁垒,在资源利用率、调度效率与业务适配性三个维度实现突破。特斯联近期正式推出的ThiCP异构算力调度平台V1.0,即依托标准化、池化、算力调度三大核心能力,为AI应用落地提供轻量化、高性能的算力底座。
当前行业普遍存在算力整卡独占、资源闲置率高、异构设备互通不畅、调度精准度不足、计费方式粗放等问题,整体算力利用率长期偏低。为此,ThiCP引入VCU(Virtual Compute Unit)虚拟算力单元,将GPU、NPU等异构资源进行标准化、精细化切分(如1 VCU相当于10%物理算力),打破整卡独占模式,支持算力按需弹性分配与多任务并行承载。配合精细化的算力与显存隔离管控,单张算力卡可同时承载多个推理任务且互不干扰。测试数据显示,基于VCU的精细化切分调度,算力利用率可提升至70%以上,单台服务器算力产出达到传统模式的1.5至2倍。此外,平台已完成多家主流厂商芯片及国产信创生态的兼容适配,支持按VCU/小时精细化计量,实现算力可管、可控、可计费,为TaaS商业模式筑牢技术根基。
业内分析认为,T-Cluster 512超节点架构与ThiCP异构算力调度平台V1.0的相继落地,展现出特斯联在AI算力领域从硬件集群到调度软件的全栈技术实力。在人工智能产业加速演进、算力需求持续扩张的背景下,这一成果有望进一步巩固公司的市场竞争力,增强各方对其成长性与商业化前景的认可,为其IPO进程注入积极动能。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.