中文

生成语法纠错人工错误的难以承受之重

计算与语言 2019-07-23 v1

摘要

近年来,序列到序列模型在端到端语法纠错(GEC)中非常有效。由于创建人工标注的 GEC 平行语料库昂贵且耗时,已有研究致力于人工语料生成,旨在从语法正确的句子生成包含真实语法错误的句子。本文中,我们研究了使用近期神经模型生成错误以帮助神经模型纠正错误的影响。我们就数据规模、模型的影响以及同基于规则方法的比较进行了一系列实验。

关键词

引用

@article{arxiv.1907.08889,
  title  = {The Unbearable Weight of Generating Artificial Errors for Grammatical Error Correction},
  author = {Phu Mon Htut and Joel Tetreault},
  journal= {arXiv preprint arXiv:1907.08889},
  year   = {2019}
}

备注

To appear at ACL-BEA workshop 2019