机器翻译在历史文档中应用的两个演示
计算与语言
2021-02-03 v1
摘要
我们展示将机器翻译应用于历史文档的两个演示。第一项任务在于生成历史文档的新版本,以其原始语言的现代版本书写。第二项应用仅限于文档的正字法。它将文档的拼写调整为现代标准,以实现拼写一致性并解决缺乏拼写规范的问题。我们遵循一种交互式、自适应框架,允许用户对系统的假设引入修正。系统通过对这些修正作出反应,生成考虑它们的新假设。一旦用户对系统假设满意并验证它,系统遵循在线学习策略调整其模型。该系统按客户端-服务器架构实现。我们开发了一个与神经模型通信的网站。所有代码均为开源并公开可用。该演示托管于 http://demosmt.prhlt.upv.es/mthd/。
引用
@article{arxiv.2102.01417,
title = {Two Demonstrations of the Machine Translation Applications to Historical Documents},
author = {Miguel Domingo and Francisco Casacuberta},
journal= {arXiv preprint arXiv:2102.01417},
year = {2021}
}
备注
Presented at the Demos session of ICPR 2020: https://www.micc.unifi.it/icpr2020/index.php/demos/