面向印度语言的统计机器翻译:Mission Hindi 2
计算与语言
2016-10-26 v1
摘要
本文介绍了孟买先进计算发展中心(CDACM)提交给2015年印度语言统计机器翻译(ILSMT)NLP工具竞赛(与ICON 2015同期举行)的作品。该竞赛旨在共同探索统计机器翻译(SMT)在印度语言内部以及英语与印度语言之间翻译的有效性。在本文中,我们报告了我们在所有五个语言对上的工作,即孟加拉语-印地语 (\bnhi)、马拉地语-印地语 (\mrhi)、泰米尔语-印地语 (\tahi)、泰卢固语-印地语 (\tehi) 和英语-印地语 (\enhi),涵盖健康、旅游和通用领域。我们在SMT训练和测试之前使用了后缀分离、复合词拆分和重排序。
引用
@article{arxiv.1610.08000,
title = {Statistical Machine Translation for Indian Languages: Mission Hindi 2},
author = {Raj Nath Patel and Prakash B. Pimpale},
journal= {arXiv preprint arXiv:1610.08000},
year = {2016}
}
备注
4 pages, Published in the Proceedings of NLP Tools Contest: Statistical Machine Translation in Indian Languages