中文

使用 Q-Learning 控制器的循迹机器人自主控制

机器人学 2020-01-27 v1 机器学习 机器学习

摘要

本文提出一种基于模拟退火(SA)的多输入多输出(MIMO)Q 学习方法以控制循迹机器人。此类机器人的常规控制器为比例(P)控制器。考虑到机器人未知的机械特性以及摩擦和打滑表面等不确定性,系统建模与控制器设计极具挑战性。本文给出了机器人的数学建模,并基于该模型设计了仿真器。基本 Q 学习方法基于纯利用,而有助于探索的 epsilon-greedy 方法会在学习完成后因探索非最优动作而损害控制器性能。基于模拟退火的 Q 学习方法通过在学习增加时降低探索率来解决这一缺陷。文中给出了仿真与实验结果以评估所提控制器的有效性。

关键词

引用

@article{arxiv.2001.08841,
  title  = {Autonomous Control of a Line Follower Robot Using a Q-Learning Controller},
  author = {Sepehr Saadatmand and Sima Azizi and Mohammadamir Kavousi and Donald Wunsch},
  journal= {arXiv preprint arXiv:2001.08841},
  year   = {2020}
}

备注

Accepted paper in IEEE CCWC 2020