中文

当古文遇见机器学习:解释分词与句法分割任务的相对表现

计算与语言 2020-07-23 v1 机器学习

摘要

我们在实验中考虑了关于中国唐代的三个主要文本来源,旨在对古文进行分割。这些语料包括《唐代墓志汇编》、《新唐书》与《旧唐书》。我们表明,利用深度学习方法获得满意的分割结果是可行的。更有趣的是,我们发现所观察到的不同实验设计之间的某些相对优势可能是可解释的。训练语料之间的相对关联性,为我们在采用不同语料组合训练分类器时所观察到的分割结果差异提供了线索与解释。

关键词

引用

@article{arxiv.2007.11171,
  title  = {When Classical Chinese Meets Machine Learning: Explaining the Relative Performances of Word and Sentence Segmentation Tasks},
  author = {Chao-Lin Liu and Chang-Ting Chu and Wei-Ting Chang and Ti-Yong Zheng},
  journal= {arXiv preprint arXiv:2007.11171},
  year   = {2020}
}

备注

4 pages, 1 figure, 2 tables, 2020 International Conference on Digital Humanities (Alliance of Digital Humanities Organizations, ADHO)