表达性与语音合成
计算与语言
2025-04-11 v2
摘要
赋予机器说话能力一直是人工智能研究的长期追求。从一开始,学界不仅旨在合成高保真语音以准确传达话语的语义含义,还希望用人类所能表达的情感范围来为其增添语调。经过多年研究,在单个孤立话语方面,我们似乎即将实现这一目标。这揭示了在将这些单个话语组合起来以合成更复杂、更长期行为方面,有大量潜在途径值得探索。在本章中,我们概述了使我们取得如此进展的方法论进展,并勾勒出为达到那个令人向往的人工表达性新水平而正在进行的努力。我们还讨论了与快速发展的表达性语音合成技术相关的社会影响,并强调了减轻这些风险、确保ESS能力与伦理规范一致的方法。
引用
@article{arxiv.2404.19363,
title = {Expressivity and Speech Synthesis},
author = {Andreas Triantafyllopoulos and Björn W. Schuller},
journal= {arXiv preprint arXiv:2404.19363},
year = {2025}
}
备注
Published in Oxford Handbook of Expressivity in Language (in press)