gym-gazebo2:基于 ROS 2 与 Gazebo 的强化学习工具包
机器人学
2019-03-19 v2 人工智能
机器学习
摘要
本文提出 gym-gazebo 的升级版、面向实际应用的版本,即基于机器人操作系统(ROS)和 Gazebo 且符合 OpenAI Gym 的强化学习(RL)工具包。文中讨论了基于 ROS 2 的新软件架构,并总结了使用近端策略优化(PPO)所获得的结果。最终,本工作成果提供了一个机器人基准测试系统,可在相同虚拟条件下比较不同技术与算法。我们评估了具有不同复杂度的模块化关节机械臂(MARA)环境,达到了毫米级精度。收敛结果表明了 gym-gazebo2 工具包的可行性及实用性、其在工业用例中使用模块化机器人的潜力与适用性。
引用
@article{arxiv.1903.06278,
title = {gym-gazebo2, a toolkit for reinforcement learning using ROS 2 and Gazebo},
author = {Nestor Gonzalez Lopez and Yue Leire Erro Nuin and Elias Barba Moral and Lander Usategui San Juan and Alejandro Solano Rueda and Víctor Mayoral Vilches and Risto Kojcev},
journal= {arXiv preprint arXiv:1903.06278},
year = {2019}
}