英韩机器翻译中结构与语义消歧的短语数据库方法
计算与语言
2015-03-20 v1
摘要
在机器翻译中,机器可读词典和标准解析规则不足以确保将英文短语解析和翻译成韩文的准确性,这表现为由于随之而来的结构和语义歧义导致的误导性翻译结果,是一种常见现象。本文旨在通过英韩机器翻译(EKMT)中应用双语短语数据库,解决由于英语中常用短语的习用性和非语法性引起的结构和语义歧义。本文首先基于英文短语的定义澄清EKMT中的短语单元是什么,其次澄清何种语言单元可作为EKMT短语数据库的目标,第三通过给出短语数据库的格式并举例提出构建短语数据库的方法,最后简要讨论将此双语短语数据库应用于EKMT进行结构和语义消歧的方法。
引用
@article{arxiv.1503.05626,
title = {Phrase database Approach to structural and semantic disambiguation in English-Korean Machine Translation},
author = {Myong-Chol Pak},
journal= {arXiv preprint arXiv:1503.05626},
year = {2015}
}