中文

卷积神经网络编码了多少位置信息?

计算机视觉与模式识别 2020-01-24 v1 机器学习

摘要

与全连接网络不同,卷积神经网络(CNN)通过学习与有限空间范围的局部滤波器相关联的权重来实现高效性。其一个隐含结果是,滤波器可能知道它在看什么,但不知道它在图像中的位置。关于绝对位置的信息本身是有用的,并且有理由假设,如果存在某种手段,深度 CNN 可能会隐式地学习编码这一信息。在本文中,我们检验了这一假设,揭示了常用神经网络中所编码的绝对位置信息令人惊讶的程度。一组全面的实验证明了该假设的有效性,并阐明了这一信息是如何以及在何处被表示的,同时为深度 CNN 中位置信息的来源提供了线索。

关键词

引用

@article{arxiv.2001.08248,
  title  = {How Much Position Information Do Convolutional Neural Networks Encode?},
  author = {Md Amirul Islam and Sen Jia and Neil D. B. Bruce},
  journal= {arXiv preprint arXiv:2001.08248},
  year   = {2020}
}

备注

Accepted to ICLR 2020