网易首页 > 网易号 > 正文 申请入驻

大模型“想太多干太少”?国内AI团队祭出多个技术大招,破解成本困局

0
分享至


智东西
作者 云鹏
编辑 漠影

当前,“龙虾”火爆全球,从消费者到企业,纷纷开始“养龙虾”,但在部分提高效率的同时,这种AI智能体所带来的问题也同样突出。

除了数据安全,处理复杂任务分分钟烧掉海量Token的问题也困扰不少用户,干活一时爽,一看账单傻眼。


海外有用户曝出,他只是问了一句“你好”,模型进行大量思考直接烧掉数十美元。

如果说个人场景尚且可以灵活处理,但企业级AI应用落地,则必须要面对高Token消耗带来的成本挑战。

OpenClaw这类Agent其实只是AI的“手脚”,背后的模型才是真正的“大脑”,要解决高消耗高成本的问题,仍然要从核心的模型入手。

当前企业在Agent模型底座的选择上面临着“两难困境”,想要高智能,就必须面对成倍Token消耗,以及推理延迟的增加,而选择低成本,则往往需要牺牲模型能力。

对企业来说,任何无效Token消耗都是真金白银的流失,因此在当下,模型效率已经成为决定企业智能的核心要素。

近来,国内AI大模型团队YuanLab.ai发布并开源了Yuan3.0 Ultra多模态基础大模型,在国内外引起较高关注。


发布当天,其在GitHub上公布了完整的模型权重、代码和技术报告:


「开源地址 」

GitHub项目:
https://github.com/Yuan-lab-LLM/Yuan3.0-Ultra
论文链接:
https://arxiv.org/abs/2601.14327

值得一提的是,这是当前业界仅有的三个万亿级开源多模态大模型之一,其最核心的创新之处在于通过LAEP技术——基于学习的自适应专家剪枝,在不破坏功能结构的情况下剪除冗余,实现了33%的参数减少,且训练速度还暴涨了49%,输出时间缩短14%的同时准确率提高16%。

可以说是真正的鱼和熊掌兼得,成本和智能“既要又要”。

从检索增强生成、多模态文档理解、表格数据分析、内容摘要与工具调用等任务,Yuan3.0 Ultra在多个企业级AI常常面对的核心场景和难点方面表现突出。


在YuanLab.ai团队看来,效率不是成本优化的“可选项”,而是模型能力的“组成部分”,他们的目标就是让企业能以更少的算力开销,产生更大的智能。

Yuan3.0 Ultra证明了旗舰级智能可以通过更高效、更经济、更可控的方式实现,可以说给企业Agent落地提供了核心能力支撑。

一、三项关键技术创新背后,如何实现“有效思考”与“极致降本”?

26年初,YuanLab.ai团队就已经发布了Yuan3.0 Flash模型,聚焦推理端效率,减少无效token消耗,通过RIRM、RAPO等核心技术创新打破了“高智能必须高Token消耗”的悖论,验证了“更少算力,并不意味着更弱能力”。

而这次发布的Yuan 3.0 Ultra旗舰模型,进一步裁除冗余专家,让模型结构更加精炼,通过LAEP、LFA、RIRM等技术实现了“不需要无节制堆算力就能获得更强智能”。

整体来看,Yuan 3.0 Ultra从预训练架构、注意力机制到推理范式,进行了全链路技术创新。基于“有效思考”技术体系,其实现了“有效规模”的进一步突破,可以说解决了大模型“参数虚高、算力浪费、落地困难”的痛点。

具体来看,其核心突破点之一是自适应专家裁剪算法(LAEP),简单来说,专家不需要更多,而在于更有效。

如果把MoE架构大模型比作一个百人研发团队,其核心优势本该是“专业分工、高效协作”,但在真实的工程实践中,却出现了严重的“团队管理失控”。

MoE大模型普遍存在预训练专家负载严重不均衡的问题,训练稳定阶段最高与最低专家负载差异可达近500倍。

少数专家承担了绝大多数计算任务,而大量低贡献专家长期处于低负载状态,造成算力资源的严重浪费,也导致模型参数虚高、利用效率低下,企业落地成本居高不下。


▲预训练过程中各层专家token分布的演化趋势(左列)及稳定阶段负载分布(右列)

简单来说:少数几个专家干了绝大多数的活,部分专家全程“摸鱼”。

行业主流MoE模型(Mixtral、DeepSeek-V3)普遍依赖辅助损失函数来约束专家利用率,“精度与均衡不可兼得”。

YuanLab.ai团队研发了自适应专家裁剪算法(LAEP),基于MoE模型预训练过程中自然形成的专家功能专一化规律,动态识别并剔除低贡献冗余专家,对模型结构进行自适应裁剪与专家重排。

具体来说,就是“多劳多得”、“按劳分配”,计算资源倾斜给价值和贡献更高的专家。

这一过程类比人类大脑学习过程中对神经连接的优化重组——保留高效信息处理通路,削弱低效连接,在维持甚至强化模型专业化能力的同时,提升算力利用效率。

从实际效果来看,预训练初始1515B参数优化至1010B,参数规模减少33.3%;预训练算力效率提升49%、单次推理仅激活68.8B参数;性能方面也处于头部阵营。


▲Yuan3.0 Ultra采用LAEP+专家重排机制有效提升机制训练效率

核心突破点之二,是语义建模能力升级,基于LFA技术强化长上下文语义关联能力。

在企业实际应用中,模型常常需要处理图文混排的财报、多页技术文档、跨文档知识检索等复杂任务。这类场景对长上下文语义关联能力要求极高——模型必须能从大量信息中精准捕捉关键内容,忽略无关干扰。

为此,Yuan3.0 Ultra引入了局部过滤注意力机制(Localized Filtering-based Attention,LFA),实现对语义关联的精准筛选与强化,有效过滤无效注意力干扰,提升模型对长上下文、复杂语义关系的建模能力,从而更准确地理解各种信息来源的脉络。

从实际效果来看,面对企业级场景中长上下文的图文混排文档解析、跨文档知识检索、多步骤Agent推理等需求,模型在长文本、复杂结构信息处理中都能保持较高准确率。

核心突破点之三,是升级“有效思考”范式,利用RIRM+RAPO技术体系,减少无效Token。这也是聚焦推理阶段另一核心浪费——大模型“过度反思”。

在Agent连续任务链中,大模型常常陷入“过度反思”——明明已经得出正确答案,却还要反复推敲,导致Token消耗成倍增加,响应延迟拉长。这种无效反思在复杂任务中尤为突出,是企业级AI落地的一大成本黑洞。

Yuan3.0 Ultra从强化学习层面入手,通过RIRM+RAPO两大技术创新根治这一顽疾:

反思抑制奖励机制(RIRM)就是在万亿参数规模的大规模强化学习中,对反思次数引入精细化奖励约束,教导模型在复杂企业级任务中,获得可靠答案后主动停止无效反思,同时保留深度推理能力,从根本上修正“过度思考”行为。


▲采用优化后的RIRM训练Yuan3.0 Ultra的动态过程,训练准确率在整个训练过程中呈现稳步上升趋势,平均响应长度随着训练的进行逐渐下降

反思感知自适应策略优化算法(RAPO)则针对万亿级MoE模型强化学习训练不稳定、效率低的行业难题,完成了算法架构的深度优化,进一步提升大规模MoE模型的训练稳定性与训练效率。

总体来看,LAEP决定了模型“用多少有效参数去学”、LFA决定了模型“如何精准捕捉有效信息”、RAPO保障了模型“如何稳定高效地学习”、RIRM明确了模型“推理到什么程度该停”。

YuanLab.ai团队一系列底层模型架构创新,让万亿级旗舰模型实现了“企业用得起、用得好、能落地”。

二、吃透企业AI应用核心场景,五项关键能力出众

诸多技术创新加持下,Yuan3.0 Ultra在大部分核心企业场景中都有出色表现,用团队的话来说,Yuan3.0 Ultra从设计阶段就针对企业真实应用场景进行能力构建,是一个能够驱动复杂智能体(Agent)的“核心引擎。

检索增强生成(RAG)领域,Yuan3.0 Ultra在ChatRAG、DocMatix等评测中取得领先成绩,可以精准定位并利用企业私域知识。

ChatRAG涵盖长文本检索、短文本与结构化检索及维基百科检索,Yuan3.0 Ultra在这项测试中的平均准确率68.2%,10项任务中9项位居首位。


在企业实际业务中,大量关键信息存在于技术方案、财报报告、行业研究材料等文档中,这些内容通常包含图文混排结构、复杂表格以及跨页面信息关联,是企业构建知识体系过程的难点。

多模态复杂表格理解评测MMTab覆盖表格问答、事实核查、长文本表格处理等多个任务类型,Yuan3.0 Ultra在这一测试中以62.3%的平均准确率超越Claude Opus 4.6和Gemini 3.1 Pro。


高质量总结生成方面,企业内部知识通常分散在文档库、知识库系统以及业务数据库中,信息来源复杂且结构不统一,要在这样的环境中获取有效信息,不仅需要检索能力,还需要对多源内容进行语义整合与综合分析。

在文本摘要生成评测SummEval中,Yuan3.0 Ultra平均精度62.8%,表现出色。这一测试从词汇重叠、语义相似度与事实一致性三个维度综合评估摘要质量,是智能体应用中历史信息压缩能力的重要参考。


精通多步骤工具调用与协作,为自动化执行复杂任务打下坚实基础,是Agent应用关键能力,在智能体工具调用方面,Yuan3.0 Ultra表现均衡,在工具调用评测BFCL V3中平均得分67.8%。


这一测试包含静态函数选择、动态实时执行、多轮上下文维护、相关性检测与无关调用拒绝等维度评估真实工具调用能力。

最后,在企业运营场景中,大量业务决策依赖数据库查询、报表分析以及跨系统数据整合,在这些场景下,企业往往需要将业务问题转化为数据库查询,并结合数据结果进行分析与总结。

在考察数据库查询语句生成能力的Text-to-SQL评测中,Yuan3.0 Ultra在Spider 1.0及BIRD评测上表现出色。

从综合测试结果来看,Yuan3.0 Ultra是真正能打的企业大模型。

结语:提升单位算力真实智能密度,打破企业两难困境

“龙虾”的火爆让我们看到了AI给个人和企业带来的巨大价值潜力,但同样也让我们看到了让AI真正能“干好活”,落地在企业场景所必然要面对的挑战。

从Flash到Ultra,YuanLab.ai团队一直在向着这一方向发力,直指企业核心痛点,其技术创新目标很明确:提升单位算力所产生的真实智能密度,让大模型的能力可以真正转化为企业可落地、可负担、可稳定使用的业务价值。

此次Yuan3.0 Ultra推动大模型从“能力展示”走向“规模化落地”,打破了困扰行业已久的成本效率困境。这是YuanLab.ai团队对下一代基础大模型结构的又一次探索实践,给业界MoE大模型结构创新、预训练算力效率提升提供了新的路径。

面向未来,AI必将更加深入地与企业业务相结合,在更多真实场景中落地,而底层模型技术的迭代仍将是核心驱动力,YuanLab.ai团队不仅给技术的探索提供了新思路,也给企业提供了用好AI的更优解。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
邹市明数亿亏损真相追踪!网传拳馆工程全由妻子亲友包揽,网友追问是否变相“掏空”

邹市明数亿亏损真相追踪!网传拳馆工程全由妻子亲友包揽,网友追问是否变相“掏空”

火山詩话
2026-07-20 08:28:06
"教师过剩"将成事实!老师们无需担心失业,大概率有三种归宿

"教师过剩"将成事实!老师们无需担心失业,大概率有三种归宿

老嫅尾声体育解说
2026-07-21 03:43:36
“恶魔千金”赵显娥:家暴丈夫,逼空姐跳机,因一袋坚果逼停飞机

“恶魔千金”赵显娥:家暴丈夫,逼空姐跳机,因一袋坚果逼停飞机

墨策史
2026-07-20 21:39:48
“二女儿长大会恨你的!”家长晒两娃名字,爱和不爱的差距太明显!

“二女儿长大会恨你的!”家长晒两娃名字,爱和不爱的差距太明显!

林林先生
2026-07-20 11:04:21
意大利有救了!曼奇尼皮尔洛靠边站,马尔蒂尼锁定历史最佳主帅

意大利有救了!曼奇尼皮尔洛靠边站,马尔蒂尼锁定历史最佳主帅

澜归序
2026-07-21 07:14:41
《八仙》逆跌破亿狂揽15亿,《功夫女足》压不住,黑马爆了

《八仙》逆跌破亿狂揽15亿,《功夫女足》压不住,黑马爆了

喜欢历史的阿繁
2026-07-20 17:09:18
这仗越打越不对劲,美国狂轰滥炸了7天,才发现伊朗是在坐地抬价

这仗越打越不对劲,美国狂轰滥炸了7天,才发现伊朗是在坐地抬价

阿芒娱乐说
2026-07-21 02:41:35
王晶透露谢贤晚年没朋友,生前照曝光瘦得皮包骨,俩孙子陪在身边

王晶透露谢贤晚年没朋友,生前照曝光瘦得皮包骨,俩孙子陪在身边

陈意小可爱
2026-07-21 02:53:36
男人到死都要记住:跟你有过肌肤之亲的女人,一定要给她花钱

男人到死都要记住:跟你有过肌肤之亲的女人,一定要给她花钱

来去自如的小章
2026-07-13 14:35:39
42岁女博士相亲,要车要房要彩礼,男子反击:我要孩子,你能生吗

42岁女博士相亲,要车要房要彩礼,男子反击:我要孩子,你能生吗

千秋文化
2026-07-18 19:14:24
伊布发问:如果这样的梅西都拿不到金球奖,还有谁配得上?

伊布发问:如果这样的梅西都拿不到金球奖,还有谁配得上?

体育闲话说
2026-07-20 15:53:46
娄山关战斗后,孔宪权重伤被迫流落贵州,组织塞下300大洋把他托付地主,15年后,他从报纸上认出了老首长,一封信让让杨勇当场摔了茶杯

娄山关战斗后,孔宪权重伤被迫流落贵州,组织塞下300大洋把他托付地主,15年后,他从报纸上认出了老首长,一封信让让杨勇当场摔了茶杯

磊子讲史
2026-07-18 18:42:24
上赛季加入讨薪大军!曝前CBA榜眼杜智博加盟广州龙狮

上赛季加入讨薪大军!曝前CBA榜眼杜智博加盟广州龙狮

狼叔评论
2026-07-21 01:17:03
1米83儿子把父亲逼崩溃,青春期的“没良心”,其实是脑子没养好

1米83儿子把父亲逼崩溃,青春期的“没良心”,其实是脑子没养好

蓁蓁心理抚养
2026-07-20 17:53:40
俄莫斯科州州长:3名中国公民在无人机袭击中受伤

俄莫斯科州州长:3名中国公民在无人机袭击中受伤

界面新闻
2026-07-20 16:32:42
曼联官宣800万签热刺拉什福德!曝转会内幕,进一队需满足两大前提

曼联官宣800万签热刺拉什福德!曝转会内幕,进一队需满足两大前提

罗米的曼联博客
2026-07-21 07:12:28
陪玩陪睡只是皮毛!继手伸进裤子后,又一女星自曝,50多都不放过

陪玩陪睡只是皮毛!继手伸进裤子后,又一女星自曝,50多都不放过

不似少年游
2026-06-22 19:32:51
重磅流言曝光!詹姆斯不来勇士,库里格林将申请交易追随老詹!

重磅流言曝光!詹姆斯不来勇士,库里格林将申请交易追随老詹!

刘哥谈体育
2026-07-21 05:37:47
89岁谢贤去世,生前将儿子送的千万劳斯莱斯卖掉,只为给女友还债

89岁谢贤去世,生前将儿子送的千万劳斯莱斯卖掉,只为给女友还债

追踪之点
2026-07-20 19:09:50
世界杯最强玄学!西班牙夺冠:4条“世界杯铁律”全部应验

世界杯最强玄学!西班牙夺冠:4条“世界杯铁律”全部应验

邱泽云
2026-07-20 20:01:01
2026-07-21 07:36:49
智东西 incentive-icons
智东西
智东西,AI产业新媒体,专注报道人工智能的前沿技术发展,和技术应用带来的千行百业产业变革。
12282文章数 117140关注度
往期回顾 全部

科技要闻

智谱暴跌,Kimi只是导火索

头条要闻

高市早苗背刺"女天皇" 代价来了

头条要闻

高市早苗背刺"女天皇" 代价来了

体育要闻

65岁肌肉男,世界杯最年长冠军主帅

娱乐要闻

谢霆锋发文确认父亲谢贤去世 享年89岁

财经要闻

AI开始挤泡沫

汽车要闻

首台量产车下线 奕境X9内饰官图发布/配华为乾崑解决方案

态度原创

艺术
游戏
教育
房产
家居

艺术要闻

世界上10个最危险景点,你敢去吗?

前《给他爱5》制作人回忆开发往事:R星砍掉许多内容

教育要闻

大名县七里店中学2026年七年级招生公告

房产要闻

北师附、人大附、西侨、丘海…招生、划片最新变化来了!

家居要闻

2026建博会(广州) 公装联探展交流活动

无障碍浏览 进入关怀版