K-pop歌词翻译:数据集、分析与神经建模
计算与语言
2024-05-21 v4 机器学习
多媒体
摘要
歌词翻译作为一个被研究逾百年的领域,正吸引计算语言学研究者。我们识别出先前研究的两项局限。首先,歌词翻译研究主要聚焦于西方体裁与语言,尽管K-pop广受欢迎却无先前研究以其为中心。其次,歌词翻译领域缺乏公开可用数据集;据我们所知,此类数据集尚不存在。为拓宽歌词翻译研究的体裁与语言范围,我们引入一个新颖的可唱歌词翻译数据集,其中约89%由K-pop歌曲歌词构成。该数据集以逐行与逐节方式对齐韩语与英语歌词。我们利用该数据集揭示了K-pop歌词翻译区别于其他被广泛研究体裁的独特特征,并构建了神经歌词翻译模型,从而凸显了专用可唱歌词翻译数据集的重要性。
引用
@article{arxiv.2309.11093,
title = {K-pop Lyric Translation: Dataset, Analysis, and Neural-Modelling},
author = {Haven Kim and Jongmin Jung and Dasaem Jeong and Juhan Nam},
journal= {arXiv preprint arXiv:2309.11093},
year = {2024}
}
备注
LREC-COLING 2024