中文

道德化语料库: 基于帧的注释与跨多样文本类型的道德化言语行动分析

计算与语言 2026-03-19 v2

摘要

道德化 - 用道德价值来为要求或立场辩护的论证 - 是一种尚未充分探索的说服性交际形式。我们提出了道德化语料库,这是一个新型的多类型数据集,旨在分析道德价值如何在论证话语中被策略性地使用。道德化在实践上具有复杂性且常常是隐式的,这对人类标注者和 NLP 系统都构成了重大挑战。我们开发了基于帧的注释方案,捕捉道德化的组成要素--道德价值、要求和话语主体--并将其应用于包括政治辩论、新闻文章和在线讨论在内的多样化德语文本。该语料库使跨沟通格式和领域的道德化语言进行细粒度分析成为可能。我们进一步评估了在 varied prompting conditions 下几个大型语言模型 (LLM) 执行道德化检测和道德化成分提取任务,并将其与人类注释进行比较,以调查道德化自动和手动分析的挑战。结果表明,详细的提示指令的效果大于 few-shot 或解释性提示,并且道德化仍是一个高度主观且情境依赖的任务。我们公开所有数据、注释指南和代码,以促进未来关于道德话语和道德推理的跨学科 NLP 研究。

关键词

引用

@article{arxiv.2512.15248,
  title  = {The Moralization Corpus: Frame-Based Annotation and Analysis of Moralizing Speech Acts across Diverse Text Genres},
  author = {Maria Becker and Mirko Sommer and Lars Tapken and Yi Wan Teh and Bruno Brocai},
  journal= {arXiv preprint arXiv:2512.15248},
  year   = {2026}
}