清华与星动纪元合作提出HEFT方法:全尺寸人形机器人L7实现负重24公斤遥操作
清华大学联合星动纪元等人提出HEFT方法,通过特权运动指导和窗口负载课程训练,实现全尺寸人形机器人L7在负重24公斤下的稳定遥操作。
AI 编撰 · 内容基于所列来源,重要信息请以原文为准
清华大学、星动纪元与上海期智研究院联合发表论文HEFT,针对全尺寸身高体型与成年人相当的机器人规格,通常指 1.6 米以上的机型,能无缝使用为人类尺度设计的工具和环境。◆ 小白科普 · 现身人形机器人外形模仿人类、有头有手有腿的机器人。最大优势是能直接使用为人类世界设计的工具和空间——楼梯、门把手、工厂工位都不在话下。◆ 小白科普 · 现身遥操作Teleoperation由人在远端控制机器人完成动作,并把这些示范记录为训练数据。◆ 小白科普 · 现身中VR参考信号噪声和实际负载导致动力学变化的问题,提出基于特权运动指导和窗口负载课程学习的解决方案。实验平台采用星动纪元L7全尺寸人形机器人,身高175厘米,体重65公斤,拥有29个驱动关节机器人身上可以转动或弯曲的连接部位。每多一个关节,就多一种动作的可能,也多一份重量、成本和故障点。◆ 小白科普 · 现身。HEFT方法将原始VR参考与经人体运动扩散重建模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身清洁后的动作分为两条流:执行网络接收原始信号以适应真机部署把机器人真正放到工作现场长期干活,而不只是在实验室演示。部署规模决定了数据回流和经验积累的速度。◆ 小白科普 · 现身,训练时则使用清洁信号计算奖励。同时,方法引入5秒窗口负载课程,先通过仿真在电脑里搭建虚拟世界来测试、训练机器人。成本低、速度快,但和真实世界总有差距。◆ 小白科普 · 现身搜索每个动作片段的最大可承受负载,再在训练中逐步提升负载量。
教师策略通过PPO训练,利用特权信息(清洁参考、接触状态、负载状态等)学习,随后通过适配器知识蒸馏至学生策略,真机部署时仅保留学生策略与适配器。实验结果显示,在真实VR噪声下,特权运动指导将末端根节点误差控制在L7上0.560米;随机动作评测中平均关节位置误差仅0.036米;双手负载从0增至30公斤时,25公斤成功率保持90%,30公斤仍有75%。真机试验中,同一部署策略成功完成5公斤篮子搬运、10公斤水桶非对称搬运、两只12公斤壶铃行走及24公斤负载下蹲等任务,验证了方法的泛化指 AI 面对没见过的新东西、新场景时也能举一反三做出正确反应的能力。这是「通用机器人」和「专用机器」的分水岭。◆ 小白科普 · 现身能力。