迈向可解释的作者验证
计算与语言
2020-07-09 v2
摘要
数字文本取证领域中多年来研究的一个核心问题是:两篇文档是否由同一作者所写。作者验证(AV)是该领域中处理此问题的研究分支。多年来,AV 相关的研究活动稳步增长,由此产生了多种试图解决该问题的方法。然而,许多方法使用的特征与文档主题相关或受其影响。因此,可能偶然出现其验证结果并非基于写作风格(AV 的实际关注点),而是基于文档主题的情况。为解决此问题,我们提出了一种替代的 AV 方法,其分类决策仅考虑与主题无关的特征。此外,我们提出了一种事后解释方法,可理解哪些特定特征对所述 AV 方法的预测作出了贡献。为评估我们 AV 方法的性能,我们在四个具有挑战性的数据集上将其与十个竞争基线(包括当前最优方法)进行比较。结果显示,我们的方法在两种情况下优于所有基线(最高准确率达 84%),而在另外两种情况下与最强基线表现相当。
引用
@article{arxiv.2006.12418,
title = {A Step Towards Interpretable Authorship Verification},
author = {Oren Halvani and Lukas Graner and Roey Regev},
journal= {arXiv preprint arXiv:2006.12418},
year = {2020}
}
备注
21 pages, 5 figures. Paper has been accepted for publication in: The 15th International Conference on Availability, Reliability and Security (ARES 2020)