中文

理解人类教师向机器人演示操作任务时的声学模式

机器人学 2022-11-02 v1

摘要

人类在向其他人类传授新技能或任务时,会有效地使用口语或言语反应形式的音频信号。虽然演示使人类能够以自然的方式教导机器人,但仅从轨迹学习并未利用包括人类教师音频在内的其他可用模态。为有效利用伴随人类演示的音频线索,首先理解此类线索所呈现和传达的信息类型十分重要。本工作使用三类特征刻画了人类教师向具身的 Sawyer 机器人演示多步操作任务时的音频:(1) 所用语音时长,(2) 语音表现力或韵律,以及 (3) 语音语义内容。我们沿四个维度分析这些特征,发现教师在 (1) 演示类型、(2) 音频使用指示、(3) 子任务和 (4) 演示期间错误等不同条件下,通过口语传达相似的语义概念。然而,沿这四个维度存在语音时长与表现力上的区分性特征,凸显人类音频承载丰富信息,可能有益于从演示学习的机器人方法的技术进展。

关键词

引用

@article{arxiv.2211.00352,
  title  = {Understanding Acoustic Patterns of Human Teachers Demonstrating Manipulation Tasks to Robots},
  author = {Akanksha Saran and Kush Desai and Mai Lee Chang and Rudolf Lioutikov and Andrea Thomaz and Scott Niekum},
  journal= {arXiv preprint arXiv:2211.00352},
  year   = {2022}
}

备注

IROS 2022