中文

操作中检索、对齐与重放的有效性探究

机器人学 2023-12-20 v1 机器学习

摘要

使用端到端行为克隆方法处理视觉观察的模仿学习效率极低。在本文中,我们探索了一种将推理分解为三个阶段的替代范式。首先是检索阶段,告知机器人可以对物体执行什么操作。其次是对齐阶段,告知机器人应在何处与物体交互。第三是重放阶段,告知机器人应如何与物体交互。通过对日常任务(如抓取、倒水和插入物体)进行的一系列真实世界实验,我们表明这种分解带来了前所未有的学习效率,以及有效的类间和类内泛化。视频可在 https://www.robot-learning.uk/retrieval-alignment-replay 获取。

关键词

引用

@article{arxiv.2312.12345,
  title  = {On the Effectiveness of Retrieval, Alignment, and Replay in Manipulation},
  author = {Norman Di Palo and Edward Johns},
  journal= {arXiv preprint arXiv:2312.12345},
  year   = {2023}
}

备注

Published in IEEE Robotics and Automation Letters (RA-L). (Accepted December 2023)