来源:第一财经
据“华为中国政企业务”公众号消息,华为与工商银行开展联合创新,成功落地Serverless NPU弹性算力调度技术方案。实测结果表明,相较于传统算力调度技术方案,Serverless NPU弹性算力调度技术方案可将千亿MoE大模型推理服务启动时间缩短至百秒级,启动效率提升10倍以上,实现算力供给模式从“长期绑定”向“按需使用”转型。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.