中文

基于含噪知识蒸馏的多语言 AMR 解析

计算与语言 2021-10-15 v2 人工智能

摘要

我们从知识蒸馏的角度研究多语言 AMR 解析,其目标是利用已有的英语解析器作为教师来学习并改进一个多语言 AMR 解析器。我们将探索限制于严格的多语言设定:仅有一个模型用于解析包括英语在内的所有不同语言。我们确认含噪输入与精确输出是成功蒸馏的关键。结合广泛的预训练,我们获得了一个 AMR 解析器,其在四种不同外语(包括德语、西班牙语、意大利语和中文)上的性能大幅超越此前所有已发表的结果(中文上最高超出 18.8 \textsc{Smatch} 点,平均超出 11.3 \textsc{Smatch} 点)。我们的解析器在英语上也取得了与最新最先进的仅英语解析器相当的性能。

关键词

引用

@article{arxiv.2109.15196,
  title  = {Multilingual AMR Parsing with Noisy Knowledge Distillation},
  author = {Deng Cai and Xin Li and Jackie Chun-Sing Ho and Lidong Bing and Wai Lam},
  journal= {arXiv preprint arXiv:2109.15196},
  year   = {2021}
}

备注

EMNLP21 (findings)