TECHNOLOGY · 技术
运动控制
东京大学提出路点引导强化学习方法,实现双臂机器人仿猿臂行
东京大学提出路点引导强化学习,使双臂机器人实现仿猿臂行并具备自主恢复能力。
AI 编撰 · 内容基于所列来源,重要信息请以原文为准
东京大学JSK团队提出路点引导强化学习一种 AI 训练方法:让机器人在亿万次「试错」中自己摸索,做对了就给奖励。机器人走稳路、跑酷空翻,大多是这么练出来的。◆ 小白科普 · 现身方法,使真人尺度双臂机器人能够实现类似灵长类的臂行运动。该方法无需完整动作示范,仅依靠稀疏末端路点引导强化学习一种 AI 训练方法:让机器人在亿万次「试错」中自己摸索,做对了就给奖励。机器人走稳路、跑酷空翻,大多是这么练出来的。◆ 小白科普 · 现身,即可生成全身协调运动,使机器人在不同单杠环境中连续摆荡,并具备抓取失败后的自主恢复能力。相关研究已被IROS 2026接收。