面向多语言文本风格迁移的基于语言与任务适配的多语言预训练
计算与语言
2022-03-17 v1
摘要
我们利用预训练的 seq2seq 模型 mBART 进行多语言文本风格迁移。使用机器翻译数据以及黄金对齐的英语句子,在我们所考虑的三种目标语言中取得了最先进的结果。此外,鉴于平行数据普遍稀缺,我们提出了一种模块化的多语言正式度迁移方法,其包含两种训练策略,分别针对语言与任务的适配。我们的方法在无单语任务特定平行数据的情况下取得了有竞争力的性能,并可应用于其他风格迁移任务以及其他语言。
引用
@article{arxiv.2203.08552,
title = {Multilingual Pre-training with Language and Task Adaptation for Multilingual Text Style Transfer},
author = {Huiyuan Lai and Antonio Toral and Malvina Nissim},
journal= {arXiv preprint arXiv:2203.08552},
year = {2022}
}
备注
Accepted to ACL 2022