中文

面向文学作品中文本世界标注的探讨

计算与语言 2021-11-16 v1

摘要

文学文本通常意蕴丰富,其解读给语料库研究与自动处理带来困难。已有若干尝试为文学作品创建带有文学要素标注(如作者话语、人物、事件、场景等)的语料库,但这些尝试仅形成了小规模集合与孤立的标注规则。本文描述了一项针对文学作品中文本世界进行词汇标注及其定量比较方法的实验。实验表明,若要实现标注者高度一致的标签指派,标注规则须设定得更为严格。然而,若文本世界与其他要素之间的边界源于主观解读,则应将它们建模为模糊实体。

关键词

引用

@article{arxiv.2111.07256,
  title  = {Towards annotation of text worlds in a literary work},
  author = {Elena Mikhalkova and Timofei Protasov and Anastasiia Drozdova and Anastasiia Bashmakova and Polina Gavin},
  journal= {arXiv preprint arXiv:2111.07256},
  year   = {2021}
}

备注

Conference: Computational Linguistics and Intellectual Technologies. Papers from the Annual International Conference Dialogue At: Moscow, Russia Volume: Issue 18. Supplementary volume