中文

FFR v1.1:丰语-法语神经机器翻译

计算与语言 2020-06-17 v1 机器学习

摘要

在世界各地,尤其是在非洲,研究人员正致力于构建神经机器翻译(NMT)系统,以帮助应对非洲这一拥有超过2000种不同语言的大陆所面临的语言障碍。然而,非洲语言的低资源性、变音符号以及声调复杂性是所面临的主要问题。FFR项目是朝着构建从丰语(一种极低资源且具有声调的语言)到法语的鲁棒翻译模型迈出的重要一步,用于研究与公共使用。在本文中,我们介绍了FFR数据集,一个丰语到法语的翻译语料库,描述了变音符号编码过程,并介绍了在我们的数据集上训练的FFR v1.1模型。该数据集与模型已在 https://github.com/ bonaventuredossou/ffr-v1 公开提供,以促进协作与可复现性。

关键词

引用

@article{arxiv.2006.09217,
  title  = {FFR v1.1: Fon-French Neural Machine Translation},
  author = {Bonaventure F. P. Dossou and Chris C. Emezue},
  journal= {arXiv preprint arXiv:2006.09217},
  year   = {2020}
}

备注

Accepted for publication at the Widening Natural Language Processing (WiNLP) Workshop, The 58th Annual Meeting of the Association for Computational Linguistics, 2020