网易首页 > 网易号 > 正文 申请入驻

AlphaGo作者领衔,DeepMind新作登Science子刊

0
分享至

henry 发自 凹非寺
量子位 | 公众号 QbitAI

一群机械臂手忙脚乱地自己干活,彼此配合、互不碰撞。

科幻大片场景真的走入现实了。优雅,实在是优雅。



△视频中为4个机械臂,在仿真环境下4个安装在桌子上,另外4个安装在天花板上。

这就是发表在Science子刊Science Robotics上,由DeepMind、Intrinsic AI和UCL等研究机构共同提出的最新成果——RoboBallet(机器芭蕾)。



RoboBallet创新性地将图神经网络(GNN)用于强化学习,作为其策略网络和状态-动作价值估计,以解决多机器人(机械臂)协作运动规划中的复杂问题。

这一方法最多可以同时控制8个机械臂,协调多达56个自由度的配置空间,并处理多达40个共享任务, 每一步规划仅需0.3毫秒,且任务分配和调度完全不受约束。

值得一提的是,这篇论文的通讯作者——Matthew Lai,可谓是谷歌DeepMind的资深研究员。自2016年加入谷歌DeepMind以来,他曾参与过AlphaGoAlphaZero等明星项目。



利用图神经网络与强化学习

总的来说,RoboBallet的核心是把图神经网络与强化学习结合起来,采用图神经网络(GNN)作为策略网络和状态-动作价值估计,解决了大规模多机器人任务分配、调度和运动规划的联合问题,实现了在计算上高效、可扩展且能零样本泛化的高质量轨迹规划

具体来说,在现代自动化制造中,核心挑战在于如何让多个机器人在共享的、充满障碍物的空间中无碰撞地高效协作,以完成大量任务(如焊接、装配等)。

这涉及到三个高度复杂的子问题:

  • 任务分配(Task Allocation):决定哪个机器人执行哪个任务,以最小化总执行时间。
  • 任务调度(Task Scheduling):决定任务的执行顺序。
  • 运动规划(Motion Planning):在关节空间中寻找一条无碰撞路径,使机器人末端执行器移动到目标姿态。

这三个子问题一组合,复杂度急剧增加,传统算法在真实场景中往往难以计算可行解,工业界目前主要依赖耗时且劳动密集的人工规划。

因此,为了应对这种高维复杂性,RoboBallet就被用来在随机生成的环境中进行任务和运动规划,其能够为与训练期间所见环境不同的环境(具有任意障碍物几何形状、任务姿态和机器人位置)规划多臂抓取轨迹。

为了实现这一点,RoboBallet在数据表示层面,创新性地将整个场景建模为图结构



其中,图中的节点代表场景中的核心实体,包括机器人、任务和障碍物,而边(Edge)则表示这些实体之间的关系(例如,相对姿态)。

机器人节点之间存在双向边,以支持相互协调和避碰。而任务节点和障碍物节点到机器人节点则存在单向边,用于向机器人传递规划所需的环境信息(如图c)

接下来,RoboBallet使用图神经网络(GNN)作为策略网络,通过权重共享来处理不断变化的图大小。其以观测图作为输入,并在每个时间步为所有机器人生成指令关节速度。这使得机械臂能够在只接收原始状态作为输入的情况下,进行关系和组合推理。

而在具体的策略学习和评估阶段,RoboBallet通过微调TD3(Twin-Delayed Deep Deterministic Policy Gradient)算法来训练策略网络,使模型能够生成多机械臂轨迹,同时解决任务分配、调度和运动规划等子问题,使得昂贵的在线计算转移到了离线训练阶段。

(注:在此任务中,机械臂因成功解决任务和避免碰撞而获得奖励)

同时,为了解决稀疏奖励的问题,RoboBallet还采用了Hindsight Experience Replay方法,使模型能够在没有人工设计的奖励函数的情况下高效学习。

在具体的部署方面,RoboBallet使用Franka Panda七自由度机械臂、在随机障碍物和任务的模拟环境进行训练。



为了验证性能,研究团队在一个包含4(8)个机器人、40个任务和30个障碍物的模拟工作单元中进行测试,并与RRT-Connect方法进行比较。值得一提的是,这一切都只需在一块 GPU(图形处理单元)上完成,无论是真实的还是模拟的多臂工作单元。

实验表明,RoboBallet在多个关键指标上表现出色:

在训练时间的扩展性方面,即使任务数量增加四倍,RoboBallet收敛所需的训练步数也只是略有增加。



在规划速度方面。实验表明,在推理阶段,即便是包含8个机器人和40个任务的最大场景,每个规划步在NVIDIA A100上只需约0.3毫秒,能够实现10 Hz时间步下超过300倍的实时规划速度

在单个Intel Cascade Lake CPU核心上,每个步长大约需要30毫秒,在10Hz时间步下仍比实时快约3倍。每个规划步骤包括对整个场景进行一次推理和一次碰撞检测。

在多智能体协同方面,随着机器人数量从4个增加到8个 ,平均执行时间减少了约60%



而在泛化性方面,模型在随机生成的环境中训练后,无需额外训练即可零样本迁移(zero-shot)到具有不同机器人位置、障碍物几何形状和任务姿态的新环境中。

最后,RoboBallet 的高速和可扩展性使其能够应用于工作单元布局优化(将任务执行时间缩短了33%)、容错规划和基于在线感知的重新规划等新能力。



[1]https://x.com/GoogleDeepMind/status/1965040645103407572

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
宗馥莉除名娃哈哈大反转,一切都结束了!

宗馥莉除名娃哈哈大反转,一切都结束了!

财经三分钟pro
2026-01-15 16:52:43
5.96万亿几乎花光:俄罗斯财政在赌什么?

5.96万亿几乎花光:俄罗斯财政在赌什么?

桂系007
2026-01-16 23:58:08
5块钱搞不定的8元套餐,在淘宝花8块4,一天就搞定了

5块钱搞不定的8元套餐,在淘宝花8块4,一天就搞定了

复转这些年
2026-01-16 23:51:17
拔出萝卜带出泥!李湘全网被禁关,王诗龄身份遭质疑,前夫已被抓

拔出萝卜带出泥!李湘全网被禁关,王诗龄身份遭质疑,前夫已被抓

一娱三分地
2026-01-16 19:22:29
一手好牌打稀烂!6主力负伤+魔鬼赛程,北京难了,许利民麻烦大了

一手好牌打稀烂!6主力负伤+魔鬼赛程,北京难了,许利民麻烦大了

后仰大风车
2026-01-17 08:20:09
国家出手,李湘全网账号被封!知情人曝原因,比闫学晶风波还恶劣

国家出手,李湘全网账号被封!知情人曝原因,比闫学晶风波还恶劣

阿纂看事
2026-01-16 14:58:49
芯片已永久转移安世中国,荷兰结局注定:费尽心机抢了一栋办公楼

芯片已永久转移安世中国,荷兰结局注定:费尽心机抢了一栋办公楼

花小猫的美食日常
2026-01-17 07:32:46
哇塞,恭喜湖人,历史级三分射手来了!

哇塞,恭喜湖人,历史级三分射手来了!

体育新角度
2026-01-17 15:33:06
杨瀚森30+20被队友毁了!轰14分17板却只出手6次,4大独狼太心累

杨瀚森30+20被队友毁了!轰14分17板却只出手6次,4大独狼太心累

嘴炮体坛
2026-01-17 12:59:32
皇马球迷拉横幅抗议78岁佛爷:离开吧!失败者 为钱出卖一切

皇马球迷拉横幅抗议78岁佛爷:离开吧!失败者 为钱出卖一切

叶青足球世界
2026-01-17 15:34:58
中超冠军欲重金引进巴西新星,林肯成转会焦点!

中超冠军欲重金引进巴西新星,林肯成转会焦点!

球天下资讯
2026-01-17 16:13:32
童年最看走眼的两个明星,一个是F4里的吴建豪,一个是SHE里的E

童年最看走眼的两个明星,一个是F4里的吴建豪,一个是SHE里的E

大铁猫娱乐
2025-12-29 16:12:25
马家军蹂躏女红军纪实!咬烂乳房、木棍捅下阴是最“仁慈”的虐待

马家军蹂躏女红军纪实!咬烂乳房、木棍捅下阴是最“仁慈”的虐待

温读史
2026-01-16 11:21:30
为救白血病丈夫,山东姑娘深夜雪地直播跳舞,目前已筹款十几万元

为救白血病丈夫,山东姑娘深夜雪地直播跳舞,目前已筹款十几万元

潇湘晨报
2026-01-17 11:46:28
1994年大案:“变态色魔”王万明,他的荒淫无耻,比你想的更恶劣

1994年大案:“变态色魔”王万明,他的荒淫无耻,比你想的更恶劣

叹为观止易
2026-01-16 10:22:49
安徽小伙在小国家创业,“享受”一夫多妻、开放生活的他如今怎样

安徽小伙在小国家创业,“享受”一夫多妻、开放生活的他如今怎样

牛牛叨史
2026-01-06 12:59:43
2026年1月存款利率大改!1万元存一年利息多少?我算透了说实在的

2026年1月存款利率大改!1万元存一年利息多少?我算透了说实在的

星辰宇的不羁
2026-01-11 10:01:20
高市早苗对华正式“宣战”!中国两邻居站队日本,特朗普告示全球

高市早苗对华正式“宣战”!中国两邻居站队日本,特朗普告示全球

来科点谱
2026-01-16 08:58:19
从国家一级演员到“淫魔”,床戏令人大开眼界,却深受观众喜欢?

从国家一级演员到“淫魔”,床戏令人大开眼界,却深受观众喜欢?

小熊侃史
2026-01-17 07:50:11
47岁吴佩慈,6年生4娃嫁不进豪门被嘲,如今因准婆婆被捕口碑逆转

47岁吴佩慈,6年生4娃嫁不进豪门被嘲,如今因准婆婆被捕口碑逆转

娱人细品
2026-01-16 16:12:36
2026-01-17 16:52:49
量子位 incentive-icons
量子位
追踪人工智能动态
12023文章数 176361关注度
往期回顾 全部

科技要闻

8亿周活扛不住烧钱 ChatGPT终向广告"低头"

头条要闻

区民政局副局长"靠老欺老":8年侵吞公共财物1257万

头条要闻

区民政局副局长"靠老欺老":8年侵吞公共财物1257万

体育要闻

三巨头走了俩,联盟笑柄却起飞了

娱乐要闻

徐家还是爱孩子的,在马筱梅生产前选择和解

财经要闻

保不准,人民币会闪击6.8!

汽车要闻

林肯贾鸣镝:稳中求进,将精细化运营进行到底

态度原创

时尚
数码
游戏
健康
公开课

岁月不败美人,50岁她们比20岁更好看

数码要闻

消息称英伟达部分承担显卡显存成本上升压力,保护消费级市场

《古墓丽影》演员谈新时代劳拉:跳脱游戏成为文化偶像

血常规3项异常,是身体警报!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版