为何未与那篇比较?识别用作基线的论文
计算与语言
2022-01-21 v1
摘要
我们提出了自动识别科学文章中用作基线的论文这一任务。我们将该问题构建为一个二分类任务,即把一篇论文中的所有参考文献分类为基线或非基线。由于基线参考文献在论文中可能出现的方式众多,这是一个具有挑战性的问题。我们基于 ACL Anthology 语料库构建了一个包含 篇论文的数据集,其所有参考文献均被人工标注为上述两类之一。我们为基线分类任务开发了一个基于多模块注意力的神经分类器,在应用于基线分类任务时优于四种最先进的引文角色分类方法。我们还对提出的分类器所犯的错误进行了分析,阐明了使基线识别成为一项挑战性问题的难点。
引用
@article{arxiv.2201.08089,
title = {Why Did You Not Compare With That? Identifying Papers for Use as Baselines},
author = {Manjot Bedi and Tanisha Pandey and Sumit Bhatia and Tanmoy Chakraborty},
journal= {arXiv preprint arXiv:2201.08089},
year = {2022}
}
备注
Preprint of upcoming paper at European Conference on Information Retrieval (ECIR) 2022