![]()
6月12日消息,第八届“北京智源大会”在中关村国际创新中心开幕。北京智源大会是智源研究院主办的“AI内行学术盛会”,以“技术前沿、国际视野、青年人才”为特色,汇聚海内外研究者分享研究成果、探寻前沿知识、交流实践经验。
![]()
本届大会,现代数字安全体系奠基者Whitfield Diffie线下参会,聚焦Agent时代的安全与可信挑战;强化学习奠基人Andrew Barto追问“交互驱动智能”对于下一代AI系统的意义。
30余位30岁以下青年科学家,40余位AI企业CEO、创始人与首席科学家,200余位顶尖专家学者将齐聚北京,中国AI产业世界模型与Agent领域最具代表性的创新力量首次集中同台。20余家全球顶尖科技企业及高校科研机构,包括Meta、英伟达、哈佛、MIT等,将与阿里、腾讯、小米、生数科技、面壁智能、清华、北大、人大等中国AI行业最核心的创新力量同场交流。
同时,大会还汇聚数百位全球AI领域学术中坚力量,一同围绕世界模型、通用智能体、具身智能、AI安全、AI Native教育、Token经济与OPC、智能计算底层架构等前沿方向展开精彩演讲和前瞻性对话。开幕式由智源研究院理事长黄铁军主持。智源研究院院长王仲远做2026年研究进展报告,发布智源研究院在基座大模型、智能体、基础软硬件生态等前沿技术领域的探索成果和开源生态建设的最新动态。
![]()
智源研究院院长王仲远
自2018年成立以来,智源研究院先后发布了“悟道”系列大模型和“悟界”系列大模型,构建了自底向上的全栈大模型开源技术体系。无论是在大模型发展的早期,还是在物理AI的全新时期,智源研究院始终在引领人工智能大模型的前沿研究探索。截至目前,智源开源模型超200个,全球总下载量累计超过10亿次。同时也孵化了一系列在大模型领域和具身智能领域非常具有代表性的创新创业企业。
一、范式迎来跃迁,智源多款重磅模型与技术体系发布
基于智源在多模态大模型以及世界大模型上的探索,智源研究院系统性地梳理了世界模型发展历程,以及对现有世界模型技术的四大分类,并介绍了正在研发中的悟界·Physis。
2024年智源大会发布的“悟界”系列大模型,旨在解决人工智能从数字世界迈向物理世界的关键能力,并且构建面向物理世界的人工智能基座模型。2025年10月正式发布的悟界·Emu3.5仅基于“预测下一个词元(Next-Token Prediction)”,实现了大规模文本、图像和视频的统一学习,实现了多模态理解和生成任务的统一学习,这一原创性的成果在今年1月份刊发于Nature正刊,创造了国产多模态大模型的众多纪录。
基座大模型方面,今年智源大会也带来了一系列创新成果发布:
悟界·Brainμ1.0是全球首个理解与生成统一的多模态神经科学大模型,将Next-Token Prediction范式扩展到神经科学领域所构建的多模态脑科学通用基座,由智源联合清华团队基于悟界·Brainμ开展的研究成果也已刊发于Science;与悟界·Brainμ1.0一同发布的还有全球最大最全的AI-Ready神经科学数据集和全球最大的AI-Ready数据平台BrainToken;
悟界·OpenComplex2.5是可泛化、物理真实的下一代AI驱动药物发现模型,能精确解析IDP灵活构象,系统性赋能创新药物研发全链路,以单一模型覆盖制药四大关键步骤。悟界·Physis-v0.1是全球首个通用世界基座模型,以统一物理状态学习,实现物理正确、动作因果可溯、长程一致、通用泛化,最终达到全垂类场景应用。
智能体方面,针对具身智能面临的硬件不成熟、数据短缺、模型能力弱、落地应用难的四大挑战,智源构建了自底向上的全栈具身智能技术体系,并先后发布了悟界·RoboBrain和悟界·RoboOS。
智源正在研发中的悟界·RoboBrain Orca,以预测下一个物理状态为核心来构建具身大脑,融合了大量Ego-centric交互数据,强化世界模型的具身表征,提升下游少样本和跨场景泛化的能力。同时,结合智源研究院作为科研机构的属性以及在科研项目上的布局,智源推出了四款自主研发的智能体,它们分别面向心脏辅助诊断、科学发现、个人专属助理以及生物安全防护等领域。
基础软硬件生态方面,智源与开源社区共建了众智FlagOS,将企业面临的“M款模型与N款芯片”适配难题简化为“多模型+多芯片”的统一接入解决方案。FlagOS2.1能够支持18家芯片厂商的32款芯片,是全球覆盖芯片数量最多的计算系统软件栈。FlagOS的算子总数已超过600个,并且仍然在快速增长。同时FlagOS还能够支持18家芯片厂商的统一编译器和12家芯片厂商的统一通信库。目前,FlagOS的生态成员已经超过80余家,全球下载量超过37.5万次,触及开发者5.6万人。
随着多模态模型的研究深入,人工智能正经历一场重大的范式变革,正在从“预测下一个词元”演进到“预测下一个物理状态”,这是世界模型的核心本质。
![]()
作为国内最早提出并开展世界模型研究的科研机构。智源认为,现有世界模型相关的技术路线可分为四类:
第一类是以语言为中心的世界模型,包括VLM、VLA,模型在文本空间中预测下一个词,学到的是语言描述的世界,并不能理解背后的物理后果;
第二类是以像素为中心的世界模型,像Sora和Seedance等视频生成类模型,在视觉空间中学习视频或图像,学到的是像素描述的世界;
第三类是以三维结构为中心的世界模型,包括3D重建以及李飞飞团队的World Labs Marble模型,不过模型重建3D空间不等于理解世界,几何结构也不代表物理状态;
第四类是以视觉表征为中心的世界模型,比如杨立昆的JEPA系列模型,预测的是视觉表征的压缩,但视觉嵌入演化不等于物理规律演化。
![]()
在智源看来,世界模型作为面向真实物理世界的下一代基座模型,以“预测下一物理状态”为核心,代表着人工智能的下一个重要范式跃迁。世界模型不仅能感知、理解、推理真实物理世界的时间、空间、物理规律和物理常识,同时能涵盖文本、视频、深度、力觉、感知等全模态数据,还具备主动交互能力,能够支撑各种物理世界的下游应用。
二、图灵奖得主与中国AI领军者,共话人工智能未来
2026北京智源大会开幕式上,图灵奖得主、美国国家工程院院士、IEEE会士Whitfield Diffie,图灵奖得主、马萨诸塞大学阿默斯特分校荣誉退休教授Andrew Barto分别做主题报告。
![]()
Whitfield Diffie以Security For AI Agents,Security Against AI Agents(护AI智能体之安,御AI智能体之险)为题进行分享。他提出,当前“控制论(反馈)”式的做法是在程序失败时进行修复,而未来的愿景应是开发形式化方法,以大幅提升程序按预期运行的可靠性。Diffie对比了密码系统因程序规模极小而可充分研究验证的优势,指出典型的计算机程序——包括编译器、操作系统、应用和智能体——规模要大得多,通常已超出人类的验证能力,人们期望这些任务未来可由AI完成。他强调,当前编程实践中,对智能体的限制(Confinement)——即保证智能体只能访问授权资源——在现有编程中仍做得不足。
![]()
Andrew Barto以Rediscovering Reinforcement Learning(重新发现强化学习)为题,将这一范式的本质归结为“控制、搜索与联想记忆”的三位一体——它既是“带着批评家的学习”,也是“试错学习”,核心在于“缓存搜索结果”而无需持续搜索。他指出,“机器学习最初就是强化学习”,而“突触可塑性实现了效果律”;
Schultz等人的“奖励预测误差假说”则印证,中脑多巴胺神经元的相位性活动所编码的,正是“新旧预期未来奖励之间的误差”。Barto 强调,“强化学习与神经网络的计算研究从一开始便紧密交织”,二者“均发端于大脑如何运作与学习的假说”,而“深度强化学习的计算能力与大脑奖励系统的最新成果相结合,指明了下一轮进展的方向”。最后,他以“小心你许的愿——你可能真的会得到它”发出警示,提醒人们警惕奖励信号设计中的“反常实例化”风险。
![]()
智源研究院理事长黄铁军与之江实验室主任、阿里云创始人王坚围绕“总有人比时代早十年”展开播客现场对话,由《漫谈 Light the Star》创始人卫诗婕主持。
对话从中国AI范式演进出发,探讨了中国大模型如何从追赶验证走向路线选择、体系构建与范式创新,如何突破互联网文本数据天花板与算力荒的极限状态,以及从“跟随国际主流范式”走向“形成自身问题意识”的原创范式跃迁等议题。
对话还聚焦Agent时代的新范式——从推理时代迈入Agent时代,海量高并发智能体对真实世界产生的直接影响与风险。面对AI 从“客体”向“主体”演进,两位嘉宾也分享了对人与AI关系、人类文明与AI文明如何共存的长期思考。
![]()
在“重构世界——中国大模型巅峰对话”圆桌环节,智源研究院院长王仲远与清华大学计算机系教授、生数科技创始人朱军,小米集团MiMo负责人罗福莉,以及清华大学计算机系教授、面壁智能联合创始人兼首席科学家刘知远,南洋理工大学校长讲席教授、人工智能交叉研究院院长安波等行业领军者,围绕超级模型能力演进、AI自进化、多模态与世界模型等核心议题深入交流,共同探讨了数字世界向物理世界跨越的重构逻辑。
嘉宾们认为,超级模型与智能体系统正进一步释放更大势能,自进化有望成为驱动智能跃迁的新引擎,多模态与世界模型的加速成熟有望推动AI真正从数字空间走向物理世界。在重构世界的进程中,同时应该为青年人才创造更广阔的探索空间。
三、智源AI科研体验区,启未来之智,溯创新之源
2026年智源大会期间,智源AI科研体验区以“启未来之智,溯创新之源”为主题,集中呈现SoulAgent、具身智能、众智FlagOS、AI for Life Science四大板块的前沿成果。观众在现场通过亲手操作、沉浸体验和现场交流,近距离感受AI如何落地真实场景、服务产业与生活。
SoulAgent是智源推出的面向个人的越用越懂你的专属智能体。在SoulAgent体验区,观众现场领取智能体,体验跨会场同步听会、与顶尖学者的AI分身实时对话。随着持续使用,SoulAgent也会不断成长,逐步成为懂用户的个人AI伙伴。
具身智能体验区让观众近距离感受AI如何与物理世界交互。在乒乓球人机对战体验区,观众亲自上场,与搭载SpikePingPong系统的人形机器人切磋球技。SpikePingPong是由智源研究院与北京大学联合推出的全球首个跨本体的人形机器人全自主乒乓球对打系统,通过高频视觉感知、球路预测、实时策略决策与机器人运动控制,使机器人看得准、反应快、打得稳,该算法已适配智元灵犀X2、远征A3、宇树G1等多类人形机器人平台。
在酒店全场景清洁体验区,观众近距离围观机器人自主完成一系列清洁任务,该区域展示了基于RoboBrainX具身通用模型、RoboClaw具身交互系统和星源智N5具身算力平台的端侧部署方案,实现长程柔性物体操作等复杂任务的同时,降低对云端网络的依赖。
众智FlagOS体验区围绕“面向多元AI芯片的开源、统一智算系统软件栈FlagOS”展开,以“可视化、可互动、可带走” 为核心理念,观众通过完成“一键启动FlagOS系统软件栈”、“FlagOS知识大闯关”、“FlagOS自动生成算子”等互动体验,直观感受FlagOS跨芯片、跨场景适配AI模型的能力。
AI for Life Science体验区分为三个区域:在安贞—智源心脏AI医院体验区,观众沿患者真实诊疗路径,依次体验AI心电图分析与智能功能筛查、透明心脏与结构病灶精准分析、BAAI Cardiac Agent、AI手术赋能。在神经科学体验区,观众深入了解BrainToken和悟界·Brainμ1.0,感受AI如何赋能基础科研、脑疾病诊疗与下一代脑机接口技术。AI药物发现体验区则呈现了悟界·OpenComplex2.5,它依托单一模型架构,解决四大关键制药步骤,核心指标超越国际标杆。
![]()
![]()
![]()
![]()
从率先开启中国大模型探索,到定义面向真实物理世界的基座模型,智源以顶尖学术突破、产业生态孵化和全栈开源布局,持续为中国AI筑牢创新根基。面向下一代人工智能技术范式变革,智源将持续引领技术创新,构建一条通往物理AGI的破局路径。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.