中文

面向印度语言的统计机器翻译:Mission Hindi 2

计算与语言 2016-10-26 v1

摘要

本文介绍了孟买先进计算发展中心(CDACM)提交给2015年印度语言统计机器翻译(ILSMT)NLP工具竞赛(与ICON 2015同期举行)的作品。该竞赛旨在共同探索统计机器翻译(SMT)在印度语言内部以及英语与印度语言之间翻译的有效性。在本文中,我们报告了我们在所有五个语言对上的工作,即孟加拉语-印地语 (\bnhi)、马拉地语-印地语 (\mrhi)、泰米尔语-印地语 (\tahi)、泰卢固语-印地语 (\tehi) 和英语-印地语 (\enhi),涵盖健康、旅游和通用领域。我们在SMT训练和测试之前使用了后缀分离、复合词拆分和重排序。

关键词

引用

@article{arxiv.1610.08000,
  title  = {Statistical Machine Translation for Indian Languages: Mission Hindi 2},
  author = {Raj Nath Patel and Prakash B. Pimpale},
  journal= {arXiv preprint arXiv:1610.08000},
  year   = {2016}
}

备注

4 pages, Published in the Proceedings of NLP Tools Contest: Statistical Machine Translation in Indian Languages