通过结论生成评估论证的充分性
计算与语言
2021-10-27 v1
摘要
论证的前提提供证据或其他理由以支持结论。然而,所需的支持程度取决于结论的普遍性、各个前提的性质等。在论证质量研究中,前提使其结论在理性上值得推出的论证被称为充分的。先前工作将充分性评估作为标准文本分类问题处理,未对前提与结论的内在关系建模。本文中,我们假设充分论证的结论可由其前提生成。为研究该假设,我们探索了基于大规模预训练语言模型输出来评估充分性的潜力。我们最佳的模型变体取得了 0.885 的 F1 分数,优于先前最优结果并与人类专家相当。尽管人工评估揭示了所生成结论的质量,其影响最终仍然有限。
引用
@article{arxiv.2110.13495,
title = {Assessing the Sufficiency of Arguments through Conclusion Generation},
author = {Timon Gurcke and Milad Alshomary and Henning Wachsmuth},
journal= {arXiv preprint arXiv:2110.13495},
year = {2021}
}