中文

为何未与那篇比较?识别用作基线的论文

计算与语言 2022-01-21 v1

摘要

我们提出了自动识别科学文章中用作基线的论文这一任务。我们将该问题构建为一个二分类任务,即把一篇论文中的所有参考文献分类为基线或非基线。由于基线参考文献在论文中可能出现的方式众多,这是一个具有挑战性的问题。我们基于 ACL Anthology 语料库构建了一个包含 2,0752,075 篇论文的数据集,其所有参考文献均被人工标注为上述两类之一。我们为基线分类任务开发了一个基于多模块注意力的神经分类器,在应用于基线分类任务时优于四种最先进的引文角色分类方法。我们还对提出的分类器所犯的错误进行了分析,阐明了使基线识别成为一项挑战性问题的难点。

关键词

引用

@article{arxiv.2201.08089,
  title  = {Why Did You Not Compare With That? Identifying Papers for Use as Baselines},
  author = {Manjot Bedi and Tanisha Pandey and Sumit Bhatia and Tanmoy Chakraborty},
  journal= {arXiv preprint arXiv:2201.08089},
  year   = {2022}
}

备注

Preprint of upcoming paper at European Conference on Information Retrieval (ECIR) 2022