中文

通过结论生成评估论证的充分性

计算与语言 2021-10-27 v1

摘要

论证的前提提供证据或其他理由以支持结论。然而,所需的支持程度取决于结论的普遍性、各个前提的性质等。在论证质量研究中,前提使其结论在理性上值得推出的论证被称为充分的。先前工作将充分性评估作为标准文本分类问题处理,未对前提与结论的内在关系建模。本文中,我们假设充分论证的结论可由其前提生成。为研究该假设,我们探索了基于大规模预训练语言模型输出来评估充分性的潜力。我们最佳的模型变体取得了 0.885 的 F1 分数,优于先前最优结果并与人类专家相当。尽管人工评估揭示了所生成结论的质量,其影响最终仍然有限。

关键词

引用

@article{arxiv.2110.13495,
  title  = {Assessing the Sufficiency of Arguments through Conclusion Generation},
  author = {Timon Gurcke and Milad Alshomary and Henning Wachsmuth},
  journal= {arXiv preprint arXiv:2110.13495},
  year   = {2021}
}