中文

扮演角色:电影中的说话人验证

声音 2021-02-12 v2 音频与语音处理

摘要

本工作的目标是研究流行的说话人识别模型在电影语音片段上的性能,其中演员常有意伪装声音以扮演角色。我们作出以下三点贡献:(i) 我们收集了一个新颖且具挑战性的说话人识别数据集 VoxMovies,包含来自近 4000 个电影片段的 856 个身份的语音。VoxMovies 包含带有不同情感、口音和背景噪声的语音,因此构成了与当前说话人识别数据集(如 VoxCeleb)中采访风格、情绪平静的语音完全不同的领域;(ii) 我们提供了若干领域自适应评测集,并在这些评测对上基准测试了最先进说话人识别模型的性能。我们表明说话人验证与识别性能在该新数据上急剧下降,显示了跨领域迁移模型的挑战;最后 (iii) 我们展示了简单的领域自适应范式可改善性能,但仍有很大改进空间。

关键词

引用

@article{arxiv.2010.15716,
  title  = {Playing a Part: Speaker Verification at the Movies},
  author = {Andrew Brown and Jaesung Huh and Arsha Nagrani and Joon Son Chung and Andrew Zisserman},
  journal= {arXiv preprint arXiv:2010.15716},
  year   = {2021}
}

备注

The first three authors contributed equally to this work