卷积神经网络编码了多少位置信息?
计算机视觉与模式识别
2020-01-24 v1 机器学习
摘要
与全连接网络不同,卷积神经网络(CNN)通过学习与有限空间范围的局部滤波器相关联的权重来实现高效性。其一个隐含结果是,滤波器可能知道它在看什么,但不知道它在图像中的位置。关于绝对位置的信息本身是有用的,并且有理由假设,如果存在某种手段,深度 CNN 可能会隐式地学习编码这一信息。在本文中,我们检验了这一假设,揭示了常用神经网络中所编码的绝对位置信息令人惊讶的程度。一组全面的实验证明了该假设的有效性,并阐明了这一信息是如何以及在何处被表示的,同时为深度 CNN 中位置信息的来源提供了线索。
引用
@article{arxiv.2001.08248,
title = {How Much Position Information Do Convolutional Neural Networks Encode?},
author = {Md Amirul Islam and Sen Jia and Neil D. B. Bruce},
journal= {arXiv preprint arXiv:2001.08248},
year = {2020}
}
备注
Accepted to ICLR 2020