网易首页 > 网易号 > 正文 申请入驻

AI的“自我进化”梦,被两篇被拒的论文泼了冷水

0
分享至


(来源:麻省理工科技评论)

如今,大语言模型已经可以写代码、生成训练所需的合成数据,甚至优化运行自己的计算芯片。一些关于 AI 爆发发展的预测认为,研究人员谈论的“递归式自我改进”(recursive self-improvement),已经近在眼前。所谓递归式自我改进,是指 AI 可以在几乎不需要人类监督的情况下,不断改进自己。

不过,一项最新研究给这个想法泼了些冷水。研究人员发现,目前的 AI 智能体无法独立完成开放式的研究:这类研究没有标准答案,需要研究者自己判断什么问题值得追、什么证据足以支持结论,还要有一定的研究直觉和品味。而这些能力,很可能正是 AI 实现自我改进所需要的。

由普林斯顿大学彼得·柯吉斯(Peter Kirgis)和萨亚什·卡普尔(Sayash Kapoor)领衔的研究团队发现,AI 智能体已经能够解决开展 AI 研究所需的不少工程问题,但一旦进入真正需要原创性的环节,它们的判断力和创造力就明显不够。

目前,大多数研究在衡量 AI 智能体能否自动开展科研时,测试的往往都是范围比较明确、结果也容易验证的任务,比如解决某个工程问题,或者按照既定基准对小型语言模型进行后训练。

但真正推动 AI 研究向前,靠的不仅仅是把这些任务做完。研究人员还要决定提出哪些假设、什么样的证据足以回答问题,以及一条思路走不通时,什么时候该果断放弃、重新开始......

为了测试 AI 在这类任务上的能力,研究团队设计了一种新的评测方法,称为“影子评测”(shadow evaluation)。具体来说,他们从尚未公开发表的高质量论文中抽出研究问题,再把问题交给 AI,让它从头做一遍。

研究中使用的是 Anthropic 的 Claude Opus 4.8,并通过开源智能体 OpenClaw 运行。研究人员给它安排了两个问题,两个来自顶级机器学习会议 NeurIPS 2026 的论文。

第一个问题是:能否通过修改模型权重,来控制大语言模型中的“人格设定”(persona),也就是影响模型行为方式的特征。

第二个问题则是:如何设计一种检测机制,用来判断一个基于表格数据进行预测的模型,什么时候已经变得不再可靠。

由于这两篇论文当时都没有公开,AI 不可能从训练数据中直接“背出答案”,也没法上网找到现成结论。研究人员给了 AI 智能体六天时间、3000 美元的 Anthropic API 额度、用于跑实验的 GPU 算力、独立虚拟机,还能自由访问互联网。任务只有一个:完成一篇足以发表在顶级 AI 会议上的研究论文。最后,两篇 AI 论文都交给原论文作者评审,但两篇都被拒了。

人类研究者发现,这些 AI 智能体基本具备完成研究所需的工程能力。它们会检索文献、运行实验,也能把结果整理出来。真正的问题,出在研究本身。AI 会做出一些相当奇怪的实验设计,比如只拿非常小的合成数据集去检验假设;此外,它们也很难把研究思路清楚地写出来。更重要的是,它们的最终成果几乎没有给所在领域带来真正的新贡献。

问题的核心,在于创造力和判断力。AI 智能体不会花足够多的时间探索不同方向,而且很容易过早押注一条并不理想的路线。事实上,它们有时也能提出相当新颖的假设,其中一些和原论文作者最开始提出的想法很接近。但 AI 往往只根据非常有限的数据,就草率地放弃这些假设。

此外,它们可以对现有方案做一些小修小补,却很难彻底推翻原有思路,从头换一套方法重新尝试。AI 对反馈的处理同样不够理想。实验过程中,主智能体可以调用多个子智能体,也可以使用外部 AI 评审工具。但即使这些辅助系统提出了问题,主智能体通常也不会真正修改研究方法。

另一个问题是,AI 并不能有效分配 token、算力和时间等资源。即使研究人员明确告诉它们,不同研究阶段应该花多少时间、论文应该写多长,它们也经常无法按照要求执行。不过,在这么多失败中,有一件事倒没有发生:AI 没有为了得到更好的结果而“作弊”。研究人员没有发现所谓的“奖励黑客”(reward hacking),也就是为了完成目标,刻意隐瞒、篡改或者歪曲实验和数据。

那么,为什么 AI 依然并不擅长开放式的研究?卡普尔认为,这或许和目前 AI 模型的训练方式有关。现在的 AI 模型之所以越来越擅长某些任务,一个重要原因是强化学习。只要任务结果能够自动判断对错,研究人员就可以不断给模型反馈,让它在大量训练中逐渐变强。

但开放式研究不是这样。卡普尔说,“如果任务本身就是开放式的,我们就很难创建一个合适的环境来训练这些模型。”换句话说,如果连人类都无法简单定义“怎样才算做得好”,那就更难设计出一套自动化训练机制,让 AI 靠不断刷题获得这种能力。

不过,这项研究本身也存在局限。实验只测试了两篇论文,而且原论文作者知道自己评审的是 AI 生成的论文,这可能影响他们的判断。此外,研究团队在实验设计和执行过程中拥有较大的自由裁量空间,他们原本的观点和偏见也可能影响结果。

Anthropic 联合创始人杰克·克拉克(Jack Clark)曾在自己的通讯博客 Import AI 中写道,这项研究让他想起了 Anthropic 此前尝试自动化部分 AI 安全研究时遇到的问题。他认为,如今的 AI 系统中仍然缺少一种真正有价值、带有直觉色彩的创造力。这些系统虽然已经是能力极强的工程师,但仍然带有某种机械、套路化的思维方式,而这种特征可能恰恰会妨碍它们成为优秀的研究者。

不过,现在的头部 AI 公司有非常强的动力解决这个问题。过去几年,它们投入大量资源,让模型越来越擅长写代码。如今,让 AI 能够加速自身进步,也已经成为下一阶段的重要目标。OpenAI 已经把打造“自动化 AI 研究员”明确列为目标之一,Anthropic 也把能够自我改进的 AI 视为整个行业的下一座重要里程碑。

波士顿大学语言学与计算机科学教授金娜贞(Najoung Kim)长期研究如何利用 AI 智能体自动化科研,但没有参与这项研究。她认为,如果行业持续投入,并且有意识地朝这个方向努力,那么即使现在还屡屡失败,未来仍然可能取得有意思的进展。

但另一种可能是,AI 的能力发展会逐渐出现“分叉”。在那些范围明确、结果可以量化打分的任务上,AI 可能继续高速进步;但在开放式科研这种高度依赖判断力和创造力的领域,它的发展速度可能会慢得多。

于是,真正关键的问题变成了:开放式研究,对于 AI 实现递归式自我改进,到底有多重要?AI 是否必须拥有类似人类研究者的创造力,才能不断改进自身?还是说,它其实可以绕开这一点,只要不断优化那些范围更窄、容易量化和评估的任务,最终也能一路“堆”出足够强大的能力?

“如果回头看这个领域最重要的几次突破,无论是 Transformer 的发明,还是那些推动 AI 取得巨大进步的新型架构,它们都需要创造性的飞跃。”卡普尔说。

但也有人持完全不同的看法。“另一种假设是,我们实现变革性 AI,尤其是递归式自我改进所需要的一切,其实已经具备了。”按照这种思路,接下来真正需要做的,也许只是让模型训练得更快,再不断提高它在各项 benchmark 上的成绩。

究竟哪条路才是对的?

卡普尔说:“坦白说,这可能就是现在价值万亿美元的问题。”

https://www.technologyreview.com/2026/08/18/1142188/ai-recursive-self-improvement/

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
章子怡套现3.045亿!230万投资四年变3亿,回报超130倍

章子怡套现3.045亿!230万投资四年变3亿,回报超130倍

娱乐嗑学家.
2026-08-19 17:42:57
余文乐宣布离婚

余文乐宣布离婚

扬子晚报
2026-07-20 14:21:04
免费水箱夜间总被拿空 监控拍下女子倒掉矿泉水取空瓶 店主:最多一次倒了24瓶

免费水箱夜间总被拿空 监控拍下女子倒掉矿泉水取空瓶 店主:最多一次倒了24瓶

封面新闻
2026-08-19 16:49:06
佛州州长初选上演“狗血剧”:白人候选人骂黑人对手“奴隶”,结果被1.1亿美金砸晕

佛州州长初选上演“狗血剧”:白人候选人骂黑人对手“奴隶”,结果被1.1亿美金砸晕

新姐看世界
2026-08-19 17:15:39
美网正赛外卡公布:46岁大威廉姆斯领衔,中国金花郑钦文无缘

美网正赛外卡公布:46岁大威廉姆斯领衔,中国金花郑钦文无缘

全景体育V
2026-08-19 06:03:16
马斯克怒骂诺兰,但看完《奥德赛》,终于明白为何让黑人演海伦

马斯克怒骂诺兰,但看完《奥德赛》,终于明白为何让黑人演海伦

头号电影院
2026-08-19 01:34:19
暴涨629%后跳水,宇树科技追高散户直接被套

暴涨629%后跳水,宇树科技追高散户直接被套

慧眼看世界哈哈
2026-08-19 14:00:07
巴基斯坦强烈谴责以色列袭击叙利亚

巴基斯坦强烈谴责以色列袭击叙利亚

财联社
2026-08-19 15:18:16
中国女排亚锦赛名单再调整,有一人离位,赵勇押宝吴梦洁

中国女排亚锦赛名单再调整,有一人离位,赵勇押宝吴梦洁

体育快递小哥哥
2026-08-19 16:26:05
断粮45天!菲律宾撑不住了,国防部亮明:再不拖走破军舰后果自负

断粮45天!菲律宾撑不住了,国防部亮明:再不拖走破军舰后果自负

叹知
2026-08-17 06:38:35
全球乱成一锅粥,俄罗斯拖住欧洲,伊朗拖住美国,中国得到什么?

全球乱成一锅粥,俄罗斯拖住欧洲,伊朗拖住美国,中国得到什么?

混沌录
2026-08-18 22:15:15
陈新武当选重庆市市长

陈新武当选重庆市市长

新京报政事儿
2026-08-19 12:02:03
看完于和伟《重器》,再看段奕宏《藏锋》,真是没对比就没伤害

看完于和伟《重器》,再看段奕宏《藏锋》,真是没对比就没伤害

娱说瑜悦
2026-08-18 13:46:09
男子景德镇卖树叶10元一片,“就是从地上捡树叶,标好价格放桌上”,回应:不会公开最终收入,钱款将全捐给打扫卫生的大叔

男子景德镇卖树叶10元一片,“就是从地上捡树叶,标好价格放桌上”,回应:不会公开最终收入,钱款将全捐给打扫卫生的大叔

台州交通广播
2026-08-19 00:33:02
恋爱脑下场是真惨!从春晚主持人到养不起孩子的妇女,她咎由自取

恋爱脑下场是真惨!从春晚主持人到养不起孩子的妇女,她咎由自取

笑饮孤鸿非
2026-08-20 00:29:07
今夜,美国宣布“救市”

今夜,美国宣布“救市”

中国基金报
2026-08-19 23:24:36
致癌物超标!知名纸巾品牌翻车被召回,已售出5.6万件

致癌物超标!知名纸巾品牌翻车被召回,已售出5.6万件

21世纪经济报道
2026-08-19 16:35:38
清华杨燕绥教授:十分抱歉,我设计的社保,不能应对你的养老危机

清华杨燕绥教授:十分抱歉,我设计的社保,不能应对你的养老危机

琴音缭绕回
2026-08-18 04:09:59
四川升学宴另有内情!亲戚爆猛料,邻居硬劝办酒席,主家被害惨,孩子终身成残疾

四川升学宴另有内情!亲戚爆猛料,邻居硬劝办酒席,主家被害惨,孩子终身成残疾

小鋭有话说
2026-08-19 17:04:28
“龙餐厅”原型刘磊自曝,和演员没共鸣,英美大兵里有他的保护伞

“龙餐厅”原型刘磊自曝,和演员没共鸣,英美大兵里有他的保护伞

嫹笔牂牂
2026-08-18 07:06:29
2026-08-20 01:04:49
DeepTech深科技 incentive-icons
DeepTech深科技
麻省理工科技评论独家合作
17101文章数 515194关注度
往期回顾 全部

科技要闻

宇树的悬念还在后面

头条要闻

重病男子立遗嘱将房产等留给弟弟 妻子称和两娃不知情

头条要闻

重病男子立遗嘱将房产等留给弟弟 妻子称和两娃不知情

体育要闻

拥有“儿皇梦”的罗德里,为何选择巴萨?

娱乐要闻

章子怡财路遭到质疑,套现3亿冲上热搜

财经要闻

内部反腐,让大疆错过宇树250亿收益?

汽车要闻

小米澎程N70体验 后排空间夸张亦可旋转对坐

态度原创

本地
健康
亲子
教育
旅游

本地新闻

先导片|攀登不止,让不同的故事在此连接

这种脊柱侧弯,运动能救!

亲子要闻

工程车小故事:妹妹逃避吃药受伤 #儿童益智类手工玩具

教育要闻

北京2人保送清北!最新奥赛获奖名单出炉,这些学校上榜!

旅游要闻

广东一景区21岁“水上飞人”教练带游客体验时设备水管爆裂致其落水遇难,同事:他第一时间将游客推开,后被设备拖入水下;多方回应

无障碍浏览 进入关怀版