中文

Milimili:通过众包收集平行数据

计算与语言 2023-07-25 v1

摘要

我们提出了一种通过众包收集平行语料库的方法,其比雇佣专业译员更具成本效益,但代价是质量有所下降。此外,我们已公开为车臣语-俄语和富拉语-英语语言对收集的试验性平行数据。

关键词

引用

@article{arxiv.2307.12282,
  title  = {Milimili. Collecting Parallel Data via Crowdsourcing},
  author = {Alexander Antonov},
  journal= {arXiv preprint arXiv:2307.12282},
  year   = {2023}
}