网易首页 > 网易号 > 正文 申请入驻

啊?微博7800美元训的大模型,数学能力超了DeepSeek-R1

0
分享至

来源:市场资讯

(来源:量子位)

当整个AI行业陷入“参数竞赛”的狂热时,微博AI交出了一份出乎意料的答卷,为沸腾的大模型战场开辟了一条充满想象力的新路径。

近日,微博正式发布首个自研开源大模型VibeThinker,这个仅拥有15亿参数的“轻量级选手”,在国际顶级数学竞赛基准测试上击败了参数量是其数百倍的、高达6710亿的DeepSeek R1模型。

更令人瞩目的是,其单次“后训练”的成本仅7800美元,对比DeepSeek-R1和MiniMax-M1等成本直接降低了几十倍。

这一突破不仅重新定义了大模型的技术评价标准,更有望推动AI产业从“规模竞赛”转向“效率革命”。


在AI发展史上,参数量曾被视为衡量模型能力的核心指标。

行业普遍认为,复杂推理能力需要1000亿以上参数才能涌现,而小模型则因无法处理高难度问题被视为“天生不足”。

但如果从小模型入手,通过巧妙的训练策略,能否挖掘出隐藏的推理能力?

微博自研开源大模型VibeThinker,给出了行业一个肯定的答案。

当大多数AI厂商仍遵循着“规模扩大即智能提升”的Scaling Law法则时,微博AI研发人员转而优化模型结构和训练范式,并创新提出了“频谱到信号原理”(SSP)方法训练,创造出了一个仅拥有15亿参数的“轻量级选手”,但在AI竞技场上战胜了超越其数百倍体量的“巨人”。

VibeThinker一经发布,立即引起了全球AI研究界的广泛关注,因其在一系列涵盖数学、编码的权威基准测试中,交出了一份出乎意料的答卷:


△HuggingFace官方主动下场发文宣传VibeThinker论文

在AIME24、AIME25以及HMMT25三个高难度数学测试集上的表现,VibeThinker超越了参数量超其400倍的模型DeepSeek-R1-0120版本(模型大小671B),与规模为456B的MiniMax-M1效果接近或相当,甚至媲美Gemini 2.5 flash和Claude Opus 4。

此外,在LiveCodeBench v6(编程算法题测试集)中的成绩,VibeThinker成功追平参数量数超其数十倍的模型,比如欧洲领先AI企业Minstral.AI的深度思考模型Magistral-Medium-2506版本。

VibeThinker雄辩地证明,通过精巧的算法设计和训练策略,一个小规模模型完全有潜力在复杂的逻辑推理任务上,达到甚至超越那些体量庞大数百倍的巨型模型,更为AI产业的成本结构、技术路线和资本布局带来了全新的思考路径。

需要说明的是,VibeThinker目前发布的版本尚处于实验性版本,其研发重点主要集中于极大强化小模型复杂数学与竞赛编程等方面的能力,其在日常聊天等能力还没有做过针对性训练优化,所以暂不适合作为日常聊天工具进行互动,更适用于数学和代码等高智能应用场景。

训练成本一直是制约AI技术普及的关键瓶颈,VibeThinker的成就不仅在于惊艳的性能,更在于其极致的成本效益

根据公开数据,2025年主流大模型单次后训练(Post-Training)成本普遍在数十万美元级别。

上海AI企业MiniMax于今年6月发布的M1模型,使用512块H800 GPU训练三周,租赁成本约53.5万美元,创始人发文表示:“第一次感觉到大山不是不能翻越。”

今年9月,AI初创公司DeepSeek(深度求索)的论文登上《自然》杂志。论文首次揭示了训练R1的成本:仅为29.4万美元。这不包括DeepSeek公司在开发R1所基于的基础LLM(即DeepSeek-V3)上花费的约600万美元,但总成本仍然远低于竞争对手模型被认为花费的数千万美元。

在这样的行业背景下,VibeThinker整个后训练过程(包括SFT和RL阶段)总共只花费了约3900个GPU小时。按照当时的市场租赁价格,总计算成本仅7800美元


这也意味着,其用不到8000美元的成本,达到了需要花费30万、甚至50万美元才能企及的性能水平,成本效益比达到了惊人的30到60倍

这种成本上的显著优势,也意味着强大的AI推理能力不再是少数科技巨头的专利,原本被巨头垄断的技术资源得以普惠,更多中小型公司、研究机构和大学,都有机会参与到前沿AI创新开发中来,极大地促进了AI研究的普惠化,推动整个行业朝着更开放、更多元、更具活力的方向发展。

技术突破的最终价值在于应用落地

微博积极拥抱人工智能发展趋势,全面促进AI技术在多项业务场景的落地。

2024年,微博自主研发“知微”大语言模型,并成功通过备案,更陆续推出微博智搜、内容总结、AI互动号等前沿功能,优化用户体验,提升内容生产和互动效率。

基于自研的“知微”大模型,微博构建了适配微博场景的AI应用生态,并创造了两大顶流AI产品:

随着自研大模型VibeThinker取得突破,更标志着微博AI战略迈入新阶段。

立足于自研大模型VibeThinker,微博的未来规划凸显了鲜明的“数据赋能”路径。公司计划深度融合其在心理等垂直领域积累的独特数据资产,目标是打造一个更洞悉公众情绪、更能服务社会化需求的专属模型。

微博不仅是在优化一个大模型,更是在解锁其数据生态的深层价值,以提供更精准、更懂用户心理状态的下一代社交服务。

VibeThinker的强大技术能力,或将成为驱动微博AI应用“多点开花”的核心引擎,深度融入平台全业务生态。

未来,VibeThinker有望在微博智搜等核心AI产品中落地,不仅能持续提升用户使用体验,更有望打破场景边界,裂变出兼具社交属性与智能服务的下一个“社交超级生态”。

此外,VibeThinker的技术突破有望大幅降低微博AI应用成本

无论是智能搜索的算力损耗,还是实时互动场景的AI响应成本,都将得到高效优化,让平台在规模化投入AI能力时无需承担过高的资源压力,进一步释放微博的生态创新能力,为用户带来更丰富、更便捷的智能体验。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
满屏荷尔蒙!网飞这一脱,又赢麻了

满屏荷尔蒙!网飞这一脱,又赢麻了

来看美剧
2025-11-17 21:10:16
真是狂妄到家!高市早苗将琉球问题摆上桌面,老美暗示要参战?

真是狂妄到家!高市早苗将琉球问题摆上桌面,老美暗示要参战?

锐器
2025-11-18 23:45:43
西安百姓怒了:市监局沦为方红卫权力余毒重灾区!

西安百姓怒了:市监局沦为方红卫权力余毒重灾区!

老萧杂说
2025-11-18 20:00:31
人社部:技能等级挂钩薪资

人社部:技能等级挂钩薪资

每日经济新闻
2025-11-18 13:23:13
上位靠睡、赶走原配!刚拿金鸡奖影后的宋佳,私生活传闻有多离谱

上位靠睡、赶走原配!刚拿金鸡奖影后的宋佳,私生活传闻有多离谱

萧鑟科普解说
2025-11-18 10:02:39
换车,就是一个巨大的消费陷阱。

换车,就是一个巨大的消费陷阱。

爱吃糖的猫cat
2025-11-16 18:14:27
里子面子都没了!邹市明赔光两亿后,冉莹颖亲手撕碎他最后的体面

里子面子都没了!邹市明赔光两亿后,冉莹颖亲手撕碎他最后的体面

赶鸭子上架
2025-11-14 15:48:42
彻底无缘世界杯的五大强队!非洲雄鹰和雄狮都出局!匈牙利无缘!

彻底无缘世界杯的五大强队!非洲雄鹰和雄狮都出局!匈牙利无缘!

林子说事
2025-11-18 07:56:32
以色列部长威胁:如联合国承认巴勒斯坦国,将暗杀巴权力机构领导

以色列部长威胁:如联合国承认巴勒斯坦国,将暗杀巴权力机构领导

桂系007
2025-11-18 23:42:45
全运会乒乓:山东女团3-2进决赛!陈梦先输后赢,约战孙颖莎争冠

全运会乒乓:山东女团3-2进决赛!陈梦先输后赢,约战孙颖莎争冠

全言作品
2025-11-18 22:21:50
继三上悠亚后相泽南宣布引退!为粉丝硬撑4年爆哭8min泪洒台湾!

继三上悠亚后相泽南宣布引退!为粉丝硬撑4年爆哭8min泪洒台湾!

素然追光
2025-11-19 00:24:10
全运游泳收官!诞生5大赢家,2人失意,2人成未来希望,一项没落

全运游泳收官!诞生5大赢家,2人失意,2人成未来希望,一项没落

篮球圈里的那些事
2025-11-17 21:01:57
世界杯历史射手榜:梅西13球 姆巴佩12球 谁能打破克洛泽16球纪录

世界杯历史射手榜:梅西13球 姆巴佩12球 谁能打破克洛泽16球纪录

智道足球
2025-11-18 19:50:32
为什么在传统中国,“人类独立”精神似乎是不存在的?

为什么在传统中国,“人类独立”精神似乎是不存在的?

尚曦读史
2025-11-12 10:43:22
又一国产车“倒下”了,10月份仅卖了1辆,是国人不识货吗?

又一国产车“倒下”了,10月份仅卖了1辆,是国人不识货吗?

诗意世界
2025-11-16 20:00:36
西部排名又变了:掘金爆冷输球,火箭剑指第2,快船掉到第12

西部排名又变了:掘金爆冷输球,火箭剑指第2,快船掉到第12

篮球大视野
2025-11-18 15:09:56
又轰下36+18+13!抱歉罗伯特森:你要从历史第一变历史第二了

又轰下36+18+13!抱歉罗伯特森:你要从历史第一变历史第二了

篮球大视野
2025-11-18 15:32:31
约基奇空砍36+18+13掘金不敌公牛结束7连胜,吉迪21+14+6

约基奇空砍36+18+13掘金不敌公牛结束7连胜,吉迪21+14+6

湖人崛起
2025-11-18 12:26:07
0-0险平!中国队无缘冠军,最大水货揪出,熊猫杯最终排名如下

0-0险平!中国队无缘冠军,最大水货揪出,熊猫杯最终排名如下

大秦壁虎白话体育
2025-11-18 21:53:48
王思聪成功和懒懒分手,回国的懒懒被曝变卖奢侈品,网友吐槽太贵

王思聪成功和懒懒分手,回国的懒懒被曝变卖奢侈品,网友吐槽太贵

娱乐团长
2025-11-16 15:45:42
2025-11-19 01:08:49
新浪财经 incentive-icons
新浪财经
新浪财经是一家创建于1999年8月的财经平台
1422196文章数 4559关注度
往期回顾 全部

科技要闻

谷歌CEO警告:若AI泡沫破裂,没公司能幸免

头条要闻

孟加拉国前总理哈西娜被判死刑 中方回应

头条要闻

孟加拉国前总理哈西娜被判死刑 中方回应

体育要闻

结束最后一次对决,陈梦和朱雨玲笑着相拥

娱乐要闻

宋佳夺影后动了谁的奶酪

财经要闻

中美机器人爆发了一场论战

汽车要闻

硬核配置旗舰气场 岚图泰山售37.99万起

态度原创

健康
时尚
旅游
本地
军事航空

警惕超声报告这六大"坑"

秋天穿衣暂时没灵感?赶紧看看这27套穿搭,舒适自然又大方

旅游要闻

取消赴日旅游的中国游客:机酒已全额退款,未来出行仍在观望

本地新闻

这档古早综艺,怎么就成了年轻人的哆啦A梦?

军事要闻

日媒扬言要"击沉福建舰" 专家:玩火自焚

无障碍浏览 进入关怀版