面向广义辅助控制的同时策略混合与系统辨识
机器人学
2022-05-23 v1 人工智能
人机交互
机器学习
摘要
在本工作中,我们解决在多个变化参数下完成复杂协作机器人任务的问题。我们的方法将同步策略混合与系统辨识相结合,以创建对系统参数变化具有鲁棒性的广义策略。我们采用一个混合网络,其状态空间仅依赖于来自系统辨识技术的参数估计。因此,该混合网络学习如何处理参数变化,而非试图同时学习如何针对广义参数集解决任务。我们在协作机器人与运动障碍人类挠痒任务中展示了我们方案的能力。随后,与标准域随机化相比,我们利用多种系统辨识技术展示了我们方法的效率。
引用
@article{arxiv.2205.09836,
title = {Concurrent Policy Blending and System Identification for Generalized Assistive Control},
author = {Luke Bhan and Marcos Quinones-Grueiro and Gautam Biswas},
journal= {arXiv preprint arXiv:2205.09836},
year = {2022}
}
备注
Accepted to ICRA 2022