中文

那是已知的谎言:检测先前已被事实核查的声明

计算与语言 2020-05-14 v1 信息检索 机器学习 社会与信息网络

摘要

近来“假新闻”的泛滥引发了许多应对措施,最显著的是若干人工事实核查倡议的出现。由此,随着时间的推移,大量已被事实核查的声明被积累下来,这使得社交媒体上的新声明或政治人物的新言论很可能已经由某个可信的事实核查组织核查过,因为病毒式传播的声明常会在社交媒体上隔段时间再次出现,而政治人物也喜欢反复重申他们偏爱的言论(无论真假)。由于人工事实核查非常耗时(且全自动事实核查存在可信度问题),重要的是尽量节省这种努力,避免在被核查过的声明上浪费时间。有趣的是,尽管该任务十分重要,迄今却被研究界在很大程度上忽视。本文旨在弥补这一空白。具体而言,我们形式化了该任务,并讨论它与先前工作的关联与区别。我们进一步创建了一个专用数据集,并发布给研究界。最后,我们给出了学习排序(learning-to-rank)实验,展示了相对于最先进的检索与文本相似度方法的显著改进。

关键词

引用

@article{arxiv.2005.06058,
  title  = {That is a Known Lie: Detecting Previously Fact-Checked Claims},
  author = {Shaden Shaar and Giovanni Da San Martino and Nikolay Babulkov and Preslav Nakov},
  journal= {arXiv preprint arXiv:2005.06058},
  year   = {2020}
}

备注

detecting previously fact-checked claims, fact-checking, disinformation, fake news, social media, political debates