中文

通过最大张力图像理解抑制机制

计算机视觉与模式识别 2024-06-11 v1

摘要

我们探讨了视觉模型中“特征抑制”的功能角色,即神经网络通过何种机制确保图像不表达特定特征。我们观察到,由于ReLU激活函数引入的不对称性,文献中的标准可解释性工具并不直接适用于抑制情形。鉴于此,我们提出通过研究“最大张力图像”(MTIs)来理解抑制,即那些同时激发和抑制给定特征的图像。我们展示了如何通过两种新颖的可视化技术研究MTIs:正负归因反转,将单张图像分解为激发和抑制成分;以及归因图谱,提供图像激发/抑制特征的各种方式的全局可视化。最后,我们探讨了叠加引入的困难,因为此类干扰特征会诱导出与MTIs相同的归因模式。

关键词

引用

@article{arxiv.2406.05598,
  title  = {Understanding Inhibition Through Maximally Tense Images},
  author = {Chris Hamblin and Srijani Saha and Talia Konkle and George Alvarez},
  journal= {arXiv preprint arXiv:2406.05598},
  year   = {2024}
}