中文

用于识别论证背后人类价值观的Touché23-ValueEval数据集

计算与语言 2023-02-01 v1

摘要

我们提出了用于识别论证背后人类价值观的Touché23-ValueEval数据集。为研究自动检测论证背后人类价值观的方法,我们从6个多样化来源收集了9324条论证,涵盖宗教文本、政治讨论、自由文本论证、报纸社论以及在线民主平台。每条论证由3名众包工作者针对54种价值观进行标注。Touché23-ValueEval数据集扩展了Webis-ArgValues-22。与先前的数据集相比,1-Baseline的有效性下降,而开箱即用的BERT模型的有效性提升。因此,尽管按标签分布来看分类难度有所增加,但更大的数据集允许训练出更好的模型。

关键词

引用

@article{arxiv.2301.13771,
  title  = {The Touch\'e23-ValueEval Dataset for Identifying Human Values behind Arguments},
  author = {Nailia Mirzakhmedova and Johannes Kiesel and Milad Alshomary and Maximilian Heinrich and Nicolas Handke and Xiaoni Cai and Barriere Valentin and Doratossadat Dastgheib and Omid Ghahroodi and Mohammad Ali Sadraei and Ehsaneddin Asgari and Lea Kawaletz and Henning Wachsmuth and Benno Stein},
  journal= {arXiv preprint arXiv:2301.13771},
  year   = {2023}
}