网易首页 > 网易号 > 正文 申请入驻

全球科研团队竞逐低成本AI模型研发新范式

0
分享至

美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(OpenAI)开发的o1、中国深度求索公司的DeepSeek-R1等,但此类尝试意味着企业可以较低成本研发出适合自身的AI应用,AI普惠性有望增强。同时,其所应用的“测试时扩展”技术或代表一条更可持续的AI研发路径。

低成本玩转高级推理

美国斯坦福大学和华盛顿大学研究团队近日宣布研发出名为s1的模型,在衡量数学和编码能力的测试中,可媲美o1和DeepSeek-R1等。研究团队称,训练租用所需的计算资源等成本只需几十美元。

s1的核心创新在于采用了“知识蒸馏”技术和“预算强制”方法。“知识蒸馏”好比把别人酿好的酒进一步提纯。该模型训练数据是基于谷歌Gemini Thinking Experimental模型“蒸馏”出的仅有1000个样本的小型数据集。

“预算强制”则使用了AI模型训练新方法——“测试时扩展”的实现方式。“测试时扩展”又称“深度思考”,核心是在模型测试阶段,通过调整计算资源分配,使模型更深入思考问题,提高推理能力和准确性。

“预算强制”通过强制提前结束或延长模型的思考过程,来影响模型的推理深度和最终答案。s1对阿里云的通义千问开源模型进行微调,通过“预算强制”控制训练后的模型计算量,使用16个英伟达H100 GPU仅进行26分钟训练便达成目标。

美国加利福尼亚大学伯克利分校研究团队最近也开发出一款名为TinyZero的精简AI模型,称复刻了DeepSeek-R1 Zero在倒计时和乘法任务中的表现。该模型通过强化学习,实现了部分相当于30亿模型参数的大语言模型的自我思维验证和搜索能力。团队称项目训练成本不到30美元。

“二次创造”增强AI普惠性

清华大学计算机系长聘副教授刘知远接受记者采访时说,部分海外研究团队使用DeepSeek-R1、o1等高性能推理大模型来构建、筛选高质量长思维链数据集,再用这些数据集微调模型,可低成本快速获得高阶推理能力。

相关专家认为,这是AI研发的有益尝试,以“二次创造”方式构建模型增强了AI普惠性。但有三点值得注意:

首先,所谓“几十美元的低成本”,并未纳入开发基座大模型的高昂成本。这就好比盖房子,只算了最后装修的钱,却没算买地、打地基的钱。AI智库“快思慢想研究院”院长田丰告诉记者,几十美元成本只是最后一个环节的算力成本,并未计算基座模型的预训练成本、数据采集加工成本。

其次,“二次创造”构建的模型,整体性能尚无法比肩成熟大模型。TinyZero仅在简单数学任务、编程及数学益智游戏等特定任务中有良好表现,但无法适用于更复杂、多样化的任务场景。而s1模型也只能通过精心挑选的训练数据,在特定测试集上超过早期版本o1 preview,而远未超过o1正式版或DeepSeek-R1。

最后,开发性能更优越的大模型,仍需强化学习技术。刘知远说,就推动大模型能力边界而言,“知识蒸馏”技术意义不大,未来仍需探索大规模强化学习技术,以持续激发大模型在思考、反思、探索等方面的能力。

AI模型未来如何进化

在2025年美国消费电子展上,美国英伟达公司高管为AI的进化勾画了一条路线图:以智能水平为纵轴、以计算量为横轴,衡量AI模型的“规模定律”呈现从“预训练扩展”到“训练后扩展”,再到“测试时扩展”的演进。

“预训练扩展”堪称“大力出奇迹”——训练数据越多、模型规模越大、投入算力越多,最终得到AI模型的能力就越强。目标是构建一个通用语言模型,以GPT早期模型为代表。而“训练后扩展”涉及强化学习和人类反馈等技术,是预训练模型的“进化”,优化其在特定领域的任务表现。

随着“预训练扩展”和“训练后扩展”边际收益逐渐递减,“测试时扩展”技术兴起。田丰说,“测试时扩展”的核心在于将焦点从训练阶段转移到推理阶段,通过动态控制推理过程中的计算量(如思考步长、迭代次数)来优化结果。这一方法不仅降低了对预训练数据的依赖,还显著提升了模型潜力。

三者在资源分配和应用场景上各有千秋。预训练像是让AI模型去学校学习基础知识,而后训练则是让模型掌握特定工作技能,如医疗、法律等专业领域。“测试时扩展”则赋予了模型更强推理能力。

AI模型的迭代还存在类似摩尔定律的现象,即能力密度随时间呈指数级增强。刘知远说,2023年以来,大模型能力密度大约每100天翻一番,即每过100天,只需要一半算力和参数就能实现相同能力。未来应继续推进计算系统智能化,不断追求更高能力密度,以更低成本,实现大模型高效发展。

(据新华社电 记者彭茜)

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
哈登太惊艳!骑士狂轰6连胜,四巨头砍58分,总冠军没悬念了?

哈登太惊艳!骑士狂轰6连胜,四巨头砍58分,总冠军没悬念了?

老侃侃球
2026-02-20 10:24:16
两名初中生扶摔倒女子,交警认定负次责,被索赔22万,依据在哪?

两名初中生扶摔倒女子,交警认定负次责,被索赔22万,依据在哪?

谭浩俊
2026-02-20 04:32:25
神奇啊!湛江妈祖小女孩被资本换掉,场面失控,法事根本无法开展

神奇啊!湛江妈祖小女孩被资本换掉,场面失控,法事根本无法开展

火山詩话
2026-02-19 16:51:56
6000万枚金弹已上膛,荷兰国家队亲自下场,中国想要回安世更难了

6000万枚金弹已上膛,荷兰国家队亲自下场,中国想要回安世更难了

凡知
2026-02-19 14:46:10
扶大妈被索赔22万后续!大妈正脸被扒已社死,索赔理由令人愤怒

扶大妈被索赔22万后续!大妈正脸被扒已社死,索赔理由令人愤怒

奇思妙想生活家
2026-02-20 02:24:25
上海网红蛋糕店被拍到发霉草莓?店铺回应:涉事人员已开除,门店停业整顿

上海网红蛋糕店被拍到发霉草莓?店铺回应:涉事人员已开除,门店停业整顿

新民晚报
2026-02-19 19:45:00
20岁华裔选手夺金!美国网友网暴谷爱凌:叛徒 贪婪的机会主义者

20岁华裔选手夺金!美国网友网暴谷爱凌:叛徒 贪婪的机会主义者

念洲
2026-02-20 08:20:53
每天7点起床画眉贴胡子,驱车1小时赶到临安衣锦城!山西00后小伙过年不回家,留在杭州当“吴越钱王”

每天7点起床画眉贴胡子,驱车1小时赶到临安衣锦城!山西00后小伙过年不回家,留在杭州当“吴越钱王”

都市快报橙柿互动
2026-02-20 00:37:22
两天连获3金!中国队反超澳大利亚英国,奖牌榜升至第12位

两天连获3金!中国队反超澳大利亚英国,奖牌榜升至第12位

奥拜尔
2026-02-20 01:31:05
哈登16+5+9+3,米切尔17分阿伦两双,骑士28分大胜篮网豪取6连胜

哈登16+5+9+3,米切尔17分阿伦两双,骑士28分大胜篮网豪取6连胜

钉钉陌上花开
2026-02-20 10:21:01
湖北宜城烟花事故发生之后,有不少人大喊追责,到底要怎么追呢?

湖北宜城烟花事故发生之后,有不少人大喊追责,到底要怎么追呢?

靠山屯闲话
2026-02-19 19:15:05
湖南新化一辆消防车坠崖,6名消防员因公牺牲

湖南新化一辆消防车坠崖,6名消防员因公牺牲

界面新闻
2026-02-19 21:34:29
大反转!雷军宣布停产,一代神车没了!

大反转!雷军宣布停产,一代神车没了!

财经要参
2026-02-18 22:21:37
2018年,张扣扣向王家复仇,唯独不杀王自新妻子:她有不死的理由

2018年,张扣扣向王家复仇,唯独不杀王自新妻子:她有不死的理由

米果说识
2026-02-19 09:32:34
50万想在妈祖面前走后门?连掷六次笑杯,这场 硬插队终被上一课

50万想在妈祖面前走后门?连掷六次笑杯,这场 硬插队终被上一课

一盅情怀
2026-02-19 18:38:36
美军集结近23年来最大空中兵力,知情人士:特朗普考虑对伊朗实施初步打击

美军集结近23年来最大空中兵力,知情人士:特朗普考虑对伊朗实施初步打击

第一财经资讯
2026-02-20 08:49:40
被张靓颖的脚硬控了!

被张靓颖的脚硬控了!

东方不败然多多
2026-02-19 23:54:17
涉重大刑案!刘述期大年初二落网,此前被悬赏3万元抓捕,逃跑时手持管铩,背带柴刀

涉重大刑案!刘述期大年初二落网,此前被悬赏3万元抓捕,逃跑时手持管铩,背带柴刀

封面新闻
2026-02-19 21:47:07
无缘本赛季奖项评选,库里将在10天后再次接受右膝伤势评估

无缘本赛季奖项评选,库里将在10天后再次接受右膝伤势评估

懂球帝
2026-02-20 09:16:14
军令如山!3月1日起全军实行终身负责制,从严治军强根基

军令如山!3月1日起全军实行终身负责制,从严治军强根基

我心纵横天地间
2026-02-19 23:15:18
2026-02-20 10:59:00
人民网 incentive-icons
人民网
报道全球 传播中国 人民网股份有限公司
445129文章数 1181768关注度
往期回顾 全部

科技要闻

莫迪举手欢呼 两大AI掌门人却握拳尴尬对峙

头条要闻

法国:欧委会派员参加所谓"和平委员会"会议未获授权

头条要闻

法国:欧委会派员参加所谓"和平委员会"会议未获授权

体育要闻

宁忠岩4年从第7到摘金,刷新奥运纪录

娱乐要闻

霍启山恋情再添实锤 和娜然同游意大利

财经要闻

太疯狂!“顾客不问价直接出手”

汽车要闻

量产甲醇插混 吉利银河星耀6甲醇插混版申报图

态度原创

数码
教育
亲子
手机
军事航空

数码要闻

Barnes & Noble推出Nook Reading Tablet 8.7阅读器

教育要闻

“这种女儿生出来当排毒了!”女孩对父亲飙脏话,单亲家庭的无奈

亲子要闻

妈妈的侥幸,就是孩子的灾难!

手机要闻

苹果手机壳专利让iPhone/iPad直连卫星群:能救命,还能刷网页

军事要闻

金正恩出席火箭炮赠送仪式 强调确保朝鲜安全环境

无障碍浏览 进入关怀版