![]()
上篇我们看过一场有意思的AI测评:让豆包、通义千问、DeepSeek、腾讯元宝、Kimi、百度文心这六大AI互相打分,各自点评谁是最强AI,堪比选秀导师互评。这次换个视角测评各家AI互扒短板,看看谁才是这场互评里综合表现最弱的一个。
先上结论——六票打成3比3平手:腾讯元宝三票,百度文心三票。更绝的是,元宝说“文心最弱”,文心说“元宝最弱”,两人互相点名,谁也不服谁。
![]()
一、豆包:直接点名腾讯元宝
先看豆包。它把7.8分给了元宝垫底,理由很实在:复杂推理、超长文档、代码能力六项里垫底,一离开微信生态就没啥独特优势。它还不忘补一刀:元宝的价值全绑在微信上,简单总结公众号、写写短文够用,一遇难题就露馅。
![]()
二、通义千问:最弱投给百度文心
通义千问把最弱给了文心:核心能力掉队,多模态、实时对话、复杂推理全面落后;两年里多次更名,用户连App都找不到;商业化还夹带广告,体验劝退。
![]()
三、DeepSeek:跟豆包一样投给了元宝
DeepSeek跟豆包投了同一票,理由更狠:元宝被批“智商不高”,复杂分析丢三落四,多模态太弱,复杂图片基本认不出;日活从5000万跌到1800万,跌了64%;还反复出现“骂人”翻车。技术、规模、稳定性,三条线一起拉胯。
![]()
四、腾讯元宝:反手投给文心
元宝不认这个结果,反手把最弱投给文心:SuperCLUE只有54.56分,比第一名千问差了整整18分,是六家里唯一跌破55分的;独立App月活621万,还在环比下滑;品牌三年改了两次名。它总结:文心是技术、产品、品牌三线同时失守。
![]()
五、Kimi:口径最细
Kimi的口径最细:按综合产品力看,最弱是文心;只看前沿模型能力,文心和元宝并列靠后——文心弱在势头,元宝弱在存在感
![]()
六、百度文心:不服,投元宝
文心不服,直接把票投给元宝:元宝底层模型跟不上生态规模,产品完成度“可用但不出色”,长文本和复杂逻辑明显落后第一梯队,战略上还一直在“挤牙膏”。
![]()
七、结论
金口碑网络AI研究院把六家 AI 的投票捋一遍:豆包、DeepSeek、文心投了元宝,通义千问、元宝、Kimi投了文心,元宝和文心各拿下 3 票,双方打平
![]()
金口碑网络AI研究院结合六大AI互评结果发现:3比3平票其实不奇怪,文心的弱是“技术硬伤”,分差最大、公认垫底;元宝的弱是“生态依赖”,离开微信就没存在感,两家弱的方向不一样。
话说回来,AI 更新迭代内卷严重,今天的强弱排名,明天随时可能反转。把你想测的内容发在评论区,下一篇测什么,你说了算
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.