不断变化世界中的鲁棒计算机视觉:应对分布偏移技术综述
计算机视觉与模式识别
2023-12-05 v1
摘要
AI 应用在公众中的可见度日益提高。研究人员对计算机视觉模型所做的理论假设与这些模型在现实世界中部署时所面临的实际情况之间存在显著差距。造成这一差距的关键原因之一是分布偏移这一极具挑战性的问题。分布偏移往往随数据复杂性、数据集规模和应用类型而变化。在本文中,我们讨论了对这一显著差距的识别,探讨了分布偏移的概念及其关键重要性。我们深入概述了各种类型的分布偏移,阐明了它们之间的区别,并探讨了以数据为中心领域内用于应对这些偏移的技术。分布偏移可能发生在机器学习流程的每个阶段,从数据收集阶段,到机器学习模型训练阶段,再到最终模型部署阶段。因此,这引发了人们对面向公众消费者部署的计算机视觉应用中机器学习技术整体鲁棒性的担忧。针对特定数据类型和任务定制的不同深度学习模型及架构流程,突出了数据预处理和特征提取的变化如何影响鲁棒性;数据增强策略(例如几何增强、合成增强和基于学习的增强)展示了其在提升模型泛化能力中的作用;而训练机制(例如迁移学习、零样本学习)则属于以数据为中心方法的范畴。我们分析的神经网络中,这些组件各自构成了不可或缺的一部分,以独特的方式为增强模型应对分布偏移的鲁棒性做出贡献。我们比较和对比了众多为缓解隐藏分层和虚假相关性中的偏移而构建的 AI 模型……
引用
@article{arxiv.2312.01540,
title = {Robust Computer Vision in an Ever-Changing World: A Survey of Techniques for Tackling Distribution Shifts},
author = {Eashan Adhikarla and Kai Zhang and Jun Yu and Lichao Sun and John Nicholson and Brian D. Davison},
journal= {arXiv preprint arXiv:2312.01540},
year = {2023}
}