中文

面向多语言可配置数据到文本系统的 NMT 辅助语法迁移评估

计算与语言 2025-01-28 v1

摘要

多语言数据到文本生成的一种方法是预先将语法配置从源语言翻译成各目标语言。然后,这些配置被表层实现器和文档规划阶段用于生成输出。在本文中,我们描述了该方法的一种基于规则的 NLG 实现,其中配置由神经机器翻译(NMT)结合一次性人工审校进行翻译,并引入跨语言语法依赖模型来创建一个多语言 NLG 系统,该系统从源数据生成文本,在无人参与的情况下扩展生成阶段。此外,我们引入了一种针对自动翻译文本的人工后期编辑评估方法。我们在 SportSett:Basketball 数据集上的评估表明,我们的 NLG 系统表现良好,凸显了其在翻译任务中的语法正确性。

关键词

引用

@article{arxiv.2501.16135,
  title  = {Evaluation of NMT-Assisted Grammar Transfer for a Multi-Language Configurable Data-to-Text System},
  author = {Andreas Madsack and Johanna Heininger and Adela Schneider and Ching-Yi Chen and Christian Eckard and Robert Weißgraeber},
  journal= {arXiv preprint arXiv:2501.16135},
  year   = {2025}
}