具身智能迎来“GPT-3时刻”:GEN-1.5模型实现3秒演示迁移
Generalist AI发布机器人基础模型GEN-1.5,仅需观看3秒人类演示即可学会新任务,无需任务专项训练,推动具身智能泛化能力发展。
AI 编撰 · 内容基于所列来源,重要信息请以原文为准
近期,Generalist AI公司正式发布其机器人基础模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身GEN-1.5,该模型AI 模型的简称,指经过训练、能从输入算出输出的程序。机器人的模型输入画面和指令,输出动作。◆ 小白科普 · 现身无需针对新任务进行专项训练,仅凭观看一段人类动作演示,机器人即可尝试直接执行相应操作。据公开演示信息,模型具备从少量演示中快速泛化指 AI 面对没见过的新东西、新场景时也能举一反三做出正确反应的能力。这是「通用机器人」和「专用机器」的分水岭。◆ 小白科普 · 现身的能力,3秒的演示视频即可引导机器人完成新工作。这一进展被视为具身智能Embodied AI让 AI 通过机器人身体感知并作用于真实世界,不只在屏幕里回答问题。◆ 小白科普 · 现身领域向“GPT-3时刻”迈进的重要信号。此前,大多数机器人学习依赖大量标注数据和冗长的训练周期,而GEN-1.5通过架构与训练策略的改进,显著降低了新任务部署把机器人真正放到工作现场长期干活,而不只是在实验室演示。部署规模决定了数据回流和经验积累的速度。◆ 小白科普 · 现身的试错成本。业内人士分析,若该模型在真实环境中保持稳定表现,将有助于缩小仿真在电脑里搭建虚拟世界来测试、训练机器人。成本低、速度快,但和真实世界总有差距。◆ 小白科普 · 现身与物理世界之间的鸿沟,并加速服务、制造等场景中的任务切换效率。目前,Generalist AI尚未披露模型参数规模、完整技术细节及商用时间表,其实际效果仍待更大规模的第三方验证。