网易首页 > 网易号 > 正文 申请入驻

三年蛰伏、匿名冲榜杀进全球前三,美团龙猫2.0如何用国产算力改写万亿参数大模型叙事?

0
分享至

2026年6月30日,美团正式发布新一代万亿参数大模型LongCat-2.0(龙猫2.0),并宣布全面开源。这不仅是美团AI战略的一次集中亮相,更是国产大模型发展史上一个标志性时刻——业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型,就此诞生。

一、五万卡国产集群:从“不可能”到“全球首个”

万亿参数大模型与国产算力的组合,在一年前仍被行业视为“不可能完成的任务”。彼时主流判断认为,国产算力卡在单卡性能、软件生态、集群稳定性等方面与英伟达体系存在代际差距,难以承载前沿大模型的训练需求。

LongCat-2.0的出现正在改写这一认知。

据悉,美团龙猫团队自2023年起便聚焦国产算力适配,从千卡规模起步,与国产算力厂商共同推进“模芯协同”研发。从早期的小规模验证到超大规模稳定训练,团队逐步攻克了万卡级容错恢复、NPU确定性计算、算力利用率提升等核心难题。

在五万卡国产算力集群上,LongCat-2.0实现了:

  • 稳定性突破:通过HCCL异常处理、弹性扩缩卡和自动故障恢复,月均日故障率降低70%以上;

  • 正确性保障:自研确定性算子、Bitwise一致性验证和参数检测,保障训练结果可靠;

  • 效率跃升:流水线调度、显存优化和算子级控核,训练MFU提升1.5倍;

  • 规模验证:稳态日吞吐超过1T tokens/day,全程未出现不可逆的loss尖刺与回滚。

LongCat-2.0的实践表明,国产算力卡的计算正确性和精度已足够满足需求,甚至局部略优,已经可以支撑前沿模型的全流程训练。

二、1.6T参数、1M上下文:硬核技术指标

LongCat-2.0采用MoE(混合专家)架构,总参数规模达到1.6万亿,平均激活约480亿参数,动态范围33B~56B。模型从零开始预训练,预训练数据规模超过30T tokens,覆盖中文、英文、多语言和代码等多类数据。

更值得关注的是其原生支持1M超长上下文,可一次处理百万字级输入。这一能力使LongCat-2.0在长文档理解、复杂代码库分析等场景中具备显著优势。

三、架构创新:LSA + 零计算专家 + MOPD

LongCat-2.0的架构设计自始至终围绕一个核心目标——让模型在真实的Agentic Coding任务中更高效、更稳定地完成代码理解、生成与执行。为此,团队引入了多项原创设计:

1. LSA稀疏注意力机制

LongCat Sparse Attention(LSA)将长文本计算量从平方级降至线性级。在处理100万Token的超长上下文时,模型不再“逐字逐句地看”,而是智能筛选关键信息,保持信息定位与理解能力。LSA通过引入流感知索引、跨层索引和分层索引,使长文本推理中的索引读取更加连续,并允许相邻层之间复用部分索引结果。

2. 零计算专家机制(业界首创)

代码任务中不同token的复杂度差异巨大——定义变量名和推导递归算法对算力的需求完全不同。LongCat-2.0通过零计算专家实现Token级动态计算预算:简单token不消耗算力,复杂token自动获得更多计算资源。这一机制为业界首创。

3. MOPD多专家融合架构

LongCat-2.0通过MOPD架构融合Agent、Reasoning、Interaction三组专家能力:

  • Agent Experts:专攻工具调用与自主纠错;

  • Reasoning Experts:深耕数学与STEM推理;

  • Interaction Experts:优化指令遵循与交互体验。

推理时由门控网络根据任务类型动态调度最擅长的专家,而非简单合并参数。

此外,模型还引入ScMoE跨层快捷连接架构和Ngram Embedding增强等多项原创设计。

四、评测屠榜:SWE-bench超越GPT-5.5和Claude Opus 4.6

硬核架构带来了硬核成绩。综合评测结果显示,LongCat-2.0在代码和通用Agent场景表现优异:

评测基准 LongCat-2.0 对比模型

SWE-bench Pro 59.5 Gemini 3.1 Pro(54.2)、GPT-5.5(58.6)、Claude Opus 4.6(57.3)

SWE-bench Multilingual 77.3 与Claude Opus 4.6(77.8)同一水位

Terminal-Bench 2.1 70.8 真实终端操作场景下稳定执行与纠错能力

在SWE-bench Pro上,LongCat-2.0领先于Gemini 3.1 Pro、GPT-5.5和Claude Opus 4.6;在SWE-bench Multilingual上与Claude Opus 4.6基本持平;Terminal-Bench 2.1的70.8分则证明了其在真实运维与开发终端任务中的稳定执行与纠错能力。

五、匿名冲榜:月调用量跻身OpenRouter全球前三

LongCat-2.0并非横空出世。

今年4月底,其预览版以匿名身份 “Owl Alpha” 接入全球最大的大模型API路由平台OpenRouter。截至6月底,总调用量已悄然跻身全球前三。

在具体Agent场景中:

  • Hermes:月调用量位列全球第一;

  • Claude Code:月调用量位列全球第二,仅次于Claude Opus 4.8;

  • OpenClaw:月调用量位列全球第三。

社区反馈显示,在工具调用、复杂指令执行等Agent核心能力方面,LongCat-2.0-Preview接近Claude Opus 4.6,在国产大模型中位列顶尖梯队。它已成为最受全球开发者欢迎的免费模型之一。

六、成本优势与开源承诺

由于算力优化和技术突破等综合因素,LongCat-2.0的训练和推理成本消耗低于全球其他万亿参数级别的大模型。

更令开发者社区振奋的是,LongCat官方宣布将于近期在多平台同步开源Infra框架、推理引擎、模型参数等核心技术,以回馈全球开发者社区。

七、行业意义:“国模+国芯”全栈协同迈出实质性一步

LongCat-2.0的落地,其意义远超一款模型的发布。

首先,它验证了国产算力大规模训练的可行性。 从“能不能用”到“好不好用”,国产算力正在跨越第一道门槛。美团用三年时间证明了国产算力卡已具备支撑前沿级万亿参数模型稳定训推的工程能力。

其次,它为行业提供了“国模+国芯”的全栈协同范本。 近半年以来,国产算力支撑大模型训练的案例正在密集涌现。正如行业人士所言:“在国产芯片上训练出大MoE模型还是很厉害的”。

第三,它印证了王兴的AI战略判断。 美团CEO王兴曾在多个场合表示,美团的AI策略是“进攻,不是防守”。自2023年初以来,美团在AI上进行了持续的大规模投入,“除有云计算业务的企业外,美团在AI上的投入规模,大概率是国内企业里最大的”。

从2023年的默默适配,到2026年6月30日的正式亮相;从五万卡国产集群的极限训练,到OpenRouter全球前三的调用量——LongCat-2.0不仅是一款产品的发布,更是一次关于“中国AI能否走出独立技术路径”的有力回答。

当技术路线的争议逐步平息,行业竞争的核心终究要回归最朴素的逻辑:谁的模型在真实场景中跑得更快、更稳、成本更低。从这个角度看,LongCat-2.0已经给出了它的答案。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
暴雨、台风等5预警齐发!今晚至明晚,广西、海南、广东、福建、浙江等地有大到暴雨;江苏、上海、浙江、福建、广西、广东等地有8-9级大风

暴雨、台风等5预警齐发!今晚至明晚,广西、海南、广东、福建、浙江等地有大到暴雨;江苏、上海、浙江、福建、广西、广东等地有8-9级大风

新快报新闻
2026-08-22 18:37:13
美军的脸都被丢尽了!谁能想到,堂堂美国海军第七舰队,最后竟然被一位愤怒的美国大妈在网上给“爆破”了?

美军的脸都被丢尽了!谁能想到,堂堂美国海军第七舰队,最后竟然被一位愤怒的美国大妈在网上给“爆破”了?

扶苏聊历史
2026-08-22 17:09:01
全身灼痛如火烤!印度男孩硬是在池塘生活5年,泡到皮肤发白都不敢上岸...

全身灼痛如火烤!印度男孩硬是在池塘生活5年,泡到皮肤发白都不敢上岸...

英国那些事儿
2026-08-22 00:40:41
俄外长警告英“参战”后果,英首相回应:将百分之百支持乌克兰

俄外长警告英“参战”后果,英首相回应:将百分之百支持乌克兰

流史岁月
2026-08-22 11:02:16
杭州酒局事件仍在发酵!曝出新消息:一个未参加酒局的人受人之托,出面斡旋,结果把自己卷入漩涡

杭州酒局事件仍在发酵!曝出新消息:一个未参加酒局的人受人之托,出面斡旋,结果把自己卷入漩涡

火山詩话
2026-08-22 06:32:54
飞机起飞后才敢官宣移民美国:安踏前CEO徐阳的“体面告别”

飞机起飞后才敢官宣移民美国:安踏前CEO徐阳的“体面告别”

天天热点见闻
2026-08-22 09:08:20
河南20岁女孩求职接连被拒,意外发现7年前被误登记为精神分裂症

河南20岁女孩求职接连被拒,意外发现7年前被误登记为精神分裂症

新京报
2026-08-22 17:47:25
菜鸡互啄!中超保级大战0-0闷平,最新保级形势:津门虎领先2分

菜鸡互啄!中超保级大战0-0闷平,最新保级形势:津门虎领先2分

中超伪球迷
2026-08-22 21:03:49
酱油为什么分生抽和老抽?“抽”是啥意思?建议弄懂再买,不吃亏

酱油为什么分生抽和老抽?“抽”是啥意思?建议弄懂再买,不吃亏

混沌录
2026-08-21 21:59:33
震惊!有在职恒大员工发朋友圈表态:只要在这家公司干过,就没有资格说他不好,至少工资没有少发一分钱

震惊!有在职恒大员工发朋友圈表态:只要在这家公司干过,就没有资格说他不好,至少工资没有少发一分钱

火山詩话
2026-08-22 11:43:08
台风“紫檀”影响华南南部和南海海域,多部门会商部署防汛防台风工作

台风“紫檀”影响华南南部和南海海域,多部门会商部署防汛防台风工作

界面新闻
2026-08-22 16:34:18
央视新版《西游记》即将上线!

央视新版《西游记》即将上线!

随州派
2026-08-22 14:56:33
突发!章建平套现40亿走人!

突发!章建平套现40亿走人!

财经要参
2026-08-22 19:00:03
惨败36分!连续无缘两届世界杯,日本男篮怎么了?

惨败36分!连续无缘两届世界杯,日本男篮怎么了?

德译洋洋
2026-08-22 12:08:56
吴谨言三亚冲浪被路人偶遇,没助理没保镖,陪老公穿成这样去度假,私下真实状态曝光

吴谨言三亚冲浪被路人偶遇,没助理没保镖,陪老公穿成这样去度假,私下真实状态曝光

东方不败然多多
2026-08-22 12:36:58
“儿子把我的头按着撞向切菜板”,杭州妈妈报警哭泣:我养了他30多年,不工作也不结婚,我伤透了心;儿子:因晚饭吃菜还是吃肉起冲突

“儿子把我的头按着撞向切菜板”,杭州妈妈报警哭泣:我养了他30多年,不工作也不结婚,我伤透了心;儿子:因晚饭吃菜还是吃肉起冲突

大风新闻
2026-08-22 21:51:03
女子花55元“捡漏”1.4万元奢侈品项链,品牌方:是系统bug,希望消费者主动申请退款;平台:愿补偿5元心意金

女子花55元“捡漏”1.4万元奢侈品项链,品牌方:是系统bug,希望消费者主动申请退款;平台:愿补偿5元心意金

新快报新闻
2026-08-22 15:45:02
4-5!中超最“惨烈”的比赛,球迷:他们拿冠军,是对足球的侮辱

4-5!中超最“惨烈”的比赛,球迷:他们拿冠军,是对足球的侮辱

汪星人哟
2026-08-22 21:36:09
经济学家马光远:根据国际经验,房地产再回到上一轮高点需要10年

经济学家马光远:根据国际经验,房地产再回到上一轮高点需要10年

史之铭
2026-08-22 18:13:05
许家印坑惨的10位大佬,马云仅排第9,第一名亏360亿遭悬赏

许家印坑惨的10位大佬,马云仅排第9,第一名亏360亿遭悬赏

天天热点见闻
2026-08-21 10:52:11
2026-08-22 22:20:49
君伟说
君伟说
分享职场故事
482文章数 48关注度
往期回顾 全部

科技要闻

苹果裁员200人:Vision Pro砍游戏团队

头条要闻

"高铁零食占座"女孩母亲:没请到假 儿童不能单独购票

头条要闻

"高铁零食占座"女孩母亲:没请到假 儿童不能单独购票

体育要闻

枪手赚翻!4000万新援揭幕战8分钟策动2球

娱乐要闻

《空枪》预测票房缩水,手握王炸都没赢

财经要闻

蔡昉解读经济:扩大消费需求的政策思考

汽车要闻

最能代表东方神韵的新旗舰 体验面子里子都拉满的比亚迪大汉

态度原创

家居
时尚
亲子
本地
军事航空

家居要闻

2026建博会(广州) 公装联探展交流活动

真爱返场|| 5年如一日的心头好,这个价格真香

亲子要闻

号称适合婴幼儿的“宝宝水”火了,泡奶一年额外花销超两千元,专家:伪概念

本地新闻

《牛来》的一声“妈妈”,到底多少人被精神污染了

军事要闻

披露林肯号航母内幕的美国军报多人被炒

无障碍浏览 进入关怀版