中文

面向日语叙事文本的拉布韦-结构分析指南

计算与语言 2026-04-01 v1

摘要

叙事分析是定性研究的基石。其中一种主要方法是拉布韦模型,但其应用工作量大程度上依赖于对转录文本中各个部分与整体文本之间进行全面、递归的解释性过程的往返移动。现有的拉布韦数据集仅提供英文版本,而英文与日语在语法和话语惯例方面存在显著差异。为弥合这一差距,我们提出了面向日语叙事文本的拉布韦叙事分析的第一个系统性指南。我们的指南保留了拉布韦模型的全部六个类别,并通过提供针对日语构造的子句分割的明确规则来扩展该框架。此外,我们的指南涵盖更广泛的子句类型和叙事类型。使用这些指南,标注员在子句分割上实现了高一致性(Fleiss' kappa = 0.80),在两个结构分类任务中实现了中等一致性(Krippendorff's alpha = 0.41 和 0.45),其中一个虽然采用更细粒度的区分,却略高于先前工作的一致性水平。本文描述了拉布韦模型、提出的指南、标注过程及其实用性。最后讨论了标注过程中遇到的挑战以及为日语定性研究中更大规模的结构叙事分析数据集的前景。

关键词

引用

@article{arxiv.2603.29347,
  title  = {Developing a Guideline for the Labovian-Structural Analysis of Oral Narratives in Japanese},
  author = {Amane Watahiki and Tomoki Doi and Akari Kikuchi and Hiroshi Ohata and Yuki I. Nakata and Takuya Niikawa and Taiga Shinozaki and Hitomi Yanaka},
  journal= {arXiv preprint arXiv:2603.29347},
  year   = {2026}
}

备注

Accepted at The Fifteenth biennial Language Resources and Evaluation Conference (LREC) 2026