图像数据增强方法:全面综述与未来方向
计算机视觉与模式识别
2023-03-14 v4 人工智能
机器学习
摘要
深度学习(DL)算法已在各类计算机视觉任务中展现出显著性能。然而,标注数据有限会导致网络过拟合问题,即网络在未见数据上的表现远差于训练数据,从而限制了性能提升。为应对该问题,人们提出了多种技术,如 dropout、归一化以及高级数据增强。其中,旨在通过引入样本多样性来扩大数据集规模的数据增强,近来成为热门话题。本文聚焦于高级数据增强技术,提供数据增强的背景、对所综述数据增强技术的全新且全面的分类体系,以及各项技术的优缺点(尽可能给出)。我们还提供了数据增强在图像分类、目标检测和语义分割三种流行计算机视觉任务上的全面结果。为可复现结果,我们汇编了所有数据增强技术的可用代码。最后,我们讨论了挑战与困难,以及可供研究界参考的未来可能方向。我们相信,本综述具有若干益处:i) 读者将理解数据增强修复过拟合问题的工作机制;ii) 结果将节省研究者用于对比的搜索时间;iii) 所述数据增强技术的代码见 https://github.com/kmr2017/Advanced-Data-augmentation-codes;iv) 未来工作将激发研究界的兴趣。
引用
@article{arxiv.2301.02830,
title = {Image Data Augmentation Approaches: A Comprehensive Survey and Future directions},
author = {Teerath Kumar and Alessandra Mileo and Rob Brennan and Malika Bendechache},
journal= {arXiv preprint arXiv:2301.02830},
year = {2023}
}
备注
We need to make a lot changes to make its quality better