通过最大张力图像理解抑制机制
计算机视觉与模式识别
2024-06-11 v1
摘要
我们探讨了视觉模型中“特征抑制”的功能角色,即神经网络通过何种机制确保图像不表达特定特征。我们观察到,由于ReLU激活函数引入的不对称性,文献中的标准可解释性工具并不直接适用于抑制情形。鉴于此,我们提出通过研究“最大张力图像”(MTIs)来理解抑制,即那些同时激发和抑制给定特征的图像。我们展示了如何通过两种新颖的可视化技术研究MTIs:正负归因反转,将单张图像分解为激发和抑制成分;以及归因图谱,提供图像激发/抑制特征的各种方式的全局可视化。最后,我们探讨了叠加引入的困难,因为此类干扰特征会诱导出与MTIs相同的归因模式。
引用
@article{arxiv.2406.05598,
title = {Understanding Inhibition Through Maximally Tense Images},
author = {Chris Hamblin and Srijani Saha and Talia Konkle and George Alvarez},
journal= {arXiv preprint arXiv:2406.05598},
year = {2024}
}