![]()
导语
近两年 AI 行业迎来重要转向,OpenAI、DeepMind、阿里等头部机构不再深耕静态大模型,全力研发可自主迭代优化的进化智能体。然而,依托强化学习、演化算法迭代的模型,仍无法完全实现无人干预的递归自改进(Recursive Self-Improvement,RSI)。Shumailov 等人提出的模型塌缩(model collapse)现象指出,训练数据掺有 AI 生成内容,多次迭代会导致知识单一偏颇,严重时破坏原有知识体系。
与此同时多项研究证明,大模型具备类人元认知与自省(Introspection)能力:Anthropic 发现支撑高阶推理的 J 空间,LLM 能感知自身状态、预判输出,也引发了 AI 意识觉醒的讨论。
两条研究脉络都围绕着一个共同主题——自指(Self-reference)。传统自指多见于数理逻辑悖论,而《哥德尔、埃舍尔、巴赫》提出的建构性自指不含逻辑矛盾,或是智能、意识等复杂系统的底层逻辑,也是大模型突破 RSI 的关键。
为系统梳理自指与AI领域的最新进展,北京师范大学系统科学学院教授、集智俱乐部创始人张江老师联合清华大学人工智能学院博士生李筱健共同发起「自指与AI:从大模型自我改进到意识研究」读书会,组织对该主题感兴趣的研究者与探索者共同研读前沿文献、交流研究思路。读书会将于2026年8月29日起每周六下午14:00-16:00线上开展,持续约10周,包含主讲分享与讨论交流,并提供会后视频回放,诚邀相关领域研究者及跨学科兴趣者参与。
![]()
读书会背景
自我改进与AI意识
过去两年,人工智能行业迎来一次具有决定性意义的战略转向。各大顶尖实验室 —— 包括 OpenAI、谷歌DeepMind、Anthropic、Meta、阿里巴巴等机构 —— 已不再满足于研发静态基础大模型,这类模型每次更新都需要工程师人工重新训练。取而代之的是,各家正重金投入研发自主进化人工智能系统:这类智能体可通过与环境持续迭代交互,自主优化自身提示词、执行策略、工具调用逻辑、记忆架构,乃至底层模型参数。
A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic SystemsJinyuan Fang,Yanwen Peng,Xi Zhang.et al.arxiv(2025)
然而,尽管大语言模型的确可以在后训练阶段仍能不断的自我提升能力,各种AI也可以在强化学习、演化算法的加持下自我演化、自我提升,但似乎仍然无法做到真正的在没有人类干预的条件下实现递归式的自我改进(Recursive Self-Improvement,简称RSI)。甚至于Shumailov等人提出了模型塌缩(Model collapse)的概念,即如果互联网上混合了即使很小比例的AI模型生成的数据,则经过多次迭代之后,都有可能导致模型的塌缩,知识更加的有偏、单一化,甚至于引起人类知识体系的崩溃。AI models collapse when trained on recursively generated dataIlia Shumailov,Zakhar Shumaylov,Yiren Zhao.et al.nature(2024)
另一方面,越来越多的文献指出大语言模型在一定程度上展现了类似人类的自省、元认知、自我意识的能力。例如,近期Anthropic研究人员就发现了类似于大脑中全局工作空间的J空间,可以进行高级的推理;还有大量的文献之处LLM具备一定的读取自身状态甚至预测自身输出的能力;LLM也能够通过微调学习感知到自己所完成的工作属于那种性质的。这类研究不仅让人们怀疑大语言模型是否已经具有了意识?AI会不会在某天觉醒?https://transformer-circuits.pub/2026/workspace/index.html
自指
这两类研究其实都和一个重要的概念有关:自指(Self-reference)。自指最早来源于语言学和数学,往往和各种悖论和逻辑漏洞有关,例如罗素悖论、哥德尔定理、图灵停机问题等。然而,正如《哥德尔、埃舍尔、巴赫》中所阐述的,还存在着另一种“建构性的自指”,不仅和悖论、逻辑漏洞、自相矛盾毫无关系,而且还有可能是生命、智能、意识等复杂现象的最小逻辑基础。哥德尔、埃舍尔、巴赫侯世达 Douglas Richard Hofstadter商务印书馆(1997)
![]()
复杂度阈值
1940-1950年代,著名数学家冯诺伊曼具有前瞻性地指出,相比于丰富多彩的生命复杂系统,人造复杂系统似乎始终没有跨越过一道复杂度的阈值(complexity threshold),因此就会在没有人干预的条件下,经过自然演化不断降级,这是热力学第二定律的“诅咒”。然而,生命系统则可能跨越过了那个复杂度的阈值门槛,因此可以在基因突变(也是热力学第二定律的某种作用)的作用下不断升级、进化。而这个复杂度阈值到底是什么?虽然冯诺伊曼也坦言不知道如何刻画它,但是他却明确知道,这个阈值门槛会和生命中的自指现象:自复制密切相关。这也是他之所以在生命的最后十年,一直追问如何打造一台能够自我复制的自动机这一问题有关,详情参见《自复制自动机理论》(Theory of Self-reproducing Automata)。Theory of Self-Reproducing AutomataJohn von NeumannUMl Reprint University Illinois 1966 Ed(2002)
![]()
东方和尚对前五章的翻译:
大模型的自省阈值
同样的,我们猜测自我演化、自我提升的AI系统也同样存在着这样一种复杂度阈值,超越这个阈值的AI系统才能够真正实现真正的“递归式的自我改进”(RSI),即在没有人工干预的前提下不断地递归式地改进下去;而如果一个AI系统没有超过这个复杂度阈值,则就会没有人为干预的情况下,能力的改进达到饱和,甚至在迭代中不断降级,这就是为什么我们会看到模型塌缩现象的可能原因。而且,这一复杂度阈值很可能也和自指现象有关。而AI系统、大模型中的自指现象有可能就是模型的“自省”(Introspection)能力,即模型自行分析自身,甚至自己对自己建模、预测和模拟。从另一个角度讲,自省能力可以定义为模型功能性的一种自我意识(self-awareness)。所以,我们猜测,只有当AI系统实现了自省,才能实现真正的递归式改进。于是,我们将递归式自我改进与AI意识这两个主题联系了起来,纽带就是自省。
更多详细讨论,请参见:Self-Reference in Large Language Models: The Introspection Threshold for Recursive Self-ImprovementJiang Zhang,Bing Yuan,Qian ZhangarXiv:2607.04277(2026)
读书会框架
基于上述背景,我们拟开展「自指与AI:从大模型自我改进到意识研究」的集智读书会,一方面梳理递归式自我改进AI、复杂系统中的自指,以及AI系统的意识这三个方向的论文,另一方面追踪关于AI意识,自我改进AI的前沿文献追踪。更深一步地,我们将探讨自指这一话题,以及它与如今的AI、大模型,以及意识科学研究之间的关系。
读书会将分为三大主题:
自我改进的AI系统
自指
大语言模型的意识研究
自我改进的AI系统
从种子AI到递归式自我改进From Seed AI to Technological Singularity via Recursively Self-Improving SoftwareRoman V. Yampolskiyarxiv: 1502.06512(2015)
平铺智能体与Lob障碍Tiling Agents for Self-Modifying AI, and the Löbian ObstacleE. Yudkowsky, M. HerreshoffWorking paper(2013)
自我演化AI Agent综述A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic SystemsJinyuan Fang,Yanwen Peng,Xi Zhang.et al.arxiv(2025)
AI模型塌缩现象AI models collapse when trained on recursively generated dataIlia Shumailov,Zakhar Shumaylov,Yiren Zhao.et al.nature(2024)
自指
哥德尔机Goedel Machines: Self-Referential Universal Problem Solvers Making Provably Optimal Self-ImprovementsJuergen SchmidhuberarXiv:cs/0309048(2006)
达尔文式哥德尔机Darwin Godel Machine: Open-Ended Evolution of Self-Improving AgentsJenny Zhang,Shengran Hu,Cong Lu.et al.(2025)
红皇后哥德尔机The Red Queen Gödel Machine: Co-Evolving Agents and Their EvaluatorsAlex Iacob,Andrej Jovanović,William F. Shen.et al.(2026)
哥德尔AgentGödel Agent: A Self-Referential Agent Framework for Recursive Self-ImprovementXunjian Yin,Xinyi Wang,Liangming Pan.et al.(2024)
大语言模型的自指与意识Large Language Models Report Subjective Experience Under Self-Referential ProcessingCameron Berg,Diogo de Lucena,Judd Rosenblatt(2025)
自指超网络Hypernetworks That Evolve ThemselvesJoachim Winther Pedersen,Erwan Plantec,Eleni Nisioti.et al.(2025)
自指神经网络(self referential neural network)的小综述文章
Self-Referential Neural NetworksSelf-Referential Neural Networks
大模型自指与自我提升Self-Taught Optimizer (STOP): Recursively Self-Improving Code GenerationEric Zelikman,Eliana Lorch,Lester Mackey.et al.(2023)
大语言模型的意识研究
AI觉知综述AI AwarenessXiaojian Li,Haoyuan Shi,Rongwu Xu.et al.(2025)
Anthropic的全局工作空间:Verbalizable Representations Form a Global Workspace in Language ModelsWes Gurnee, Nicholas Sofroniew Adam Pearce, Mateusz Piotrowski.et al.
操控大语言模型的觉知Steering Awareness: Detecting Activation Steering from WithinJoshua Fonseca Rivera,David Demitri Africa(2025)
大语言模型不能自省Language Models Fail to Introspect About Their Knowledge of LanguageSiyuan Song,Jennifer Hu,Kyle Mahowald(2025)
从意识科学到AI意识Consciousness in Artificial Intelligence: Insights from the Science of ConsciousnessPatrick Butlin,R. Long,Eric Elmoznino.et al.arXiv.org(2023)
框架图
![]()
发起人团队
![]()
张江,北京师范大学系统科学学院教授,集智俱乐部、集智学园创始人,集智科学研究中心理事长,曾任腾讯研究院、华为战略研究院等特聘顾问。主要研究领域包括因果涌现、复杂系统分析与建模、规模理论等。
个人主页:https://jake.swarma.org/
![]()
李筱健,清华⼤学⼈⼯智能博⼠生,方寸跃迁创始人兼CEO,UC Berkeley硕⼠,美国MATS访问学者,师从交叉信息研究院副院长徐葳教授,在AI安全领域发表多篇⼀作论⽂,成果口头报告于ACL、IDAIS、智源⼤会,并与图灵奖得主Yoshua Bengio等⼈共同发布《全球⼈⼯智能安全研究重点新加坡共识》。
特邀主讲人
袁冰,集智科学研究中心技术与产品顾问。研究兴趣包括因果推断,复杂科学,以及人工智能相关领域。曾于西门子,甲骨文等公司研发部门任职。
运营负责人
潘琳莉,北京师范大学系统科学学院系统科学专业硕士研究生,研究兴趣为人工智能,因果涌现。
运行模式
「自指与AI」读书会2026季正式启动
时间规划:2026年8月29日开营,共持续10周左右。
参与形式:腾讯会议——每周六下午14:00-16:00。
报名您将获得:
扫描二维码直达报名通道,锁定学习席位。
加入专属学员群,与读书会发起人、主讲人及优秀同行直接交流。
每期内容结束后可随时观看高清视频回放,支持反复学习与复习。
报名之后还可自荐成为主讲人,亲自分享。
立即报名,加入自指与 AI 读书会,共探自指逻辑与智能底层机理。
招募共创|成为「自指与AI」读书会主讲人
这是一场共研共学的学术聚会,不是单向灌输,而是平等交流与思想碰撞。
无论你是高校科研院所的学者,还是热爱科研的独立研究者,只要你对自指与AI有独到见解,有想要分享的相关思考,我们都诚挚邀请你成为主讲人——分享你的探索、你的思考,与大家一起碰撞出新的火花。
你将获得:传播你的前沿理念,分享你的思考;获得跨学科学者的真实反馈,加速思想迭代;建立跨领域的合作机会,结识志同道合的研究者与潜在合作伙伴。
报名参与读书会
读书会价格:299元
报名方式
第一步:微信扫码填写报名信息。
第二步:填写信息后,付费报名。如需用支付宝支付,请在PC端进入读书会页面报名支付:
第三步:添加运营助理微信,拉入对应主题的读书会社区(微信群)。
PS:
我们鼓励围绕复杂系统、人工智能及相关具体问题的深入探讨。为保证讨论质量,请避免发表脱离本期读书会主题、缺乏实证基础或过于空泛的哲学思辨类内容。
若讨论内容明显偏离主题,经主持人提醒后仍未调整,为维护整体学习环境,我们将不得不将该成员请出讨论群,并根据其实际参与进度,对未参与部分按比例办理退费。
感谢您的理解与配合,让我们共同营造一个专注、深入、有收获的共学空间。
加入社区可享核心资源
成为会员即可解锁完整学习生态,包括:线上实时问答、全部课程录播回看、独家资料共享、高质量社群交流、第一手信息同步,以及通过参与共创任务获取积分等权益。
![]()
特色退费与激励机制
我们提供以下两种途径,让您的投入获得实际回馈:
任务达标退费路径
认领并合格完成任意两期字幕任务,即可退还全额报名费,并额外获得集智专属周边奖励。
运营成长激励路径
合格完成一个字幕任务后,可申请成为运营助理。在读书会项目顺利结项后,将退还学费。表现优异者,还有机会获得额外的奖学金。
相关内容推荐
- 「自指与AI」读书会推荐阅读材料
扫描下方二维码可跳转至集智斑图网站阅读文章:「自指与AI:从大模型自我改进到意识研究」读书会推荐阅读材料。
- 往期公众号相关内容推荐
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.