中文

计算机视觉中的深度强化学习:全面综述

计算机视觉与模式识别 2021-08-27 v1 人工智能

摘要

深度强化学习增强了强化学习框架,并利用了深度神经网络强大的表示能力。近期的工作展示了深度强化学习在金融、医学、医疗保健、电子游戏、机器人和计算机视觉等多个领域的显著成功。在这项工作中,我们对计算机视觉中深度强化学习的最新和最先进的研究进展进行了详细回顾。我们从理解深度学习、强化学习和深度强化学习的理论开始。然后,我们提出了一种深度强化学习方法的分类,并讨论了它们的优点和局限性。特别地,我们根据深度强化学习在计算机视觉中的应用将其划分为七个主要类别,即 (i) 关键点定位 (ii) 目标检测;(iii) 目标跟踪;(iv) 2D 图像和 3D 图像体数据的配准 (v) 图像分割;(vi) 视频分析;以及 (vii) 其他应用。每个类别都进一步从强化学习技术、网络设计和性能方面进行了分析。此外,我们对现有的公开可用数据集进行了全面分析,并检查了源代码的可用性。最后,我们提出了一些开放性问题,并讨论了计算机视觉中深度强化学习的未来研究方向。

关键词

引用

@article{arxiv.2108.11510,
  title  = {Deep Reinforcement Learning in Computer Vision: A Comprehensive Survey},
  author = {Ngan Le and Vidhiwar Singh Rathour and Kashu Yamazaki and Khoa Luu and Marios Savvides},
  journal= {arXiv preprint arXiv:2108.11510},
  year   = {2021}
}