新京报贝壳财经讯 6月6日晚,面壁智能发布端侧大模型MiniCPM 4.0。面壁智能称,新模型通过自研CPM.cu极速端侧推理框架,在极限场景下实现最高220倍、常规5倍速度提升;以仅2.7%的训练开销,达到一半参数、性能翻倍效果;贡献了行业首例全开源的系统级上下文稀疏化高效创新;支持在vLLM、SGLang、LlamaFactory等框架部署。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.