9 月 28 日,华为正式开源 openPangu-2.0 全套代码,包含预训练、SFT 微调、强化学习 RL 完整训练管线,不是只开放模型权重,而是把整套训练流程全部对外开放,在国产基础大模型里属于少见的开放力度。
以往很多开源大模型,仅仅放出模型权重文件,开发者只能直接调用模型,想自主复现训练、修改底层训练逻辑难度很高。而盘古 openPangu-2.0 直接放出全套代码,开发者可以基于这套代码,在国产昇腾算力集群上,完整复现大模型从预训练到对齐的全流程。
这个动作最大的意义,是完善国产算力生态。很多企业想用国产芯片训练大模型,但是缺少成熟、可落地的训练代码,适配成本极高。盘古开源整套管线,大幅降低基于昇腾集群开发大模型的门槛,帮助更多中小企业在国产算力底座上开发行业模型、AI 智能体。
对比海外巨头,OpenAI、Anthropic 前沿模型基本封闭,只开放 API 调用。而国内选择持续开源基础模型,本质是用开放生态换取应用落地。但开源也有挑战,企业拿到代码之后,训练、推理依然需要大量算力投入,对于中小团队来说,算力成本依旧是最大门槛。
国产大模型已经走过 “能不能做出来” 的阶段,现在的核心任务,就是搭建完整生态,让更多行业场景落地。
你觉得全流程开源,会加速国产大模型商业化落地吗?
#算力##开源AI#
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.