中文

StylePitcher:生成符合风格且富有表现力的演唱曲线

声音 2025-10-27 v1

摘要

现有的音高曲线生成器面临两个主要挑战:它们往往忽视歌手-specific 的表现力,降低了捕捉个体演唱风格的能力。并且它们通常开发为特定任务(如音高校正、合成人声、语音转换)的辅助模块,这限制了其泛化能力。我们提出StylePitcher,一个通用的音高曲线生成器,从参考音频中学习歌手风格,同时保持与预期旋律的对齐。基于rectified flow matching架构,StylePitcher灵活地将符号音乐谱和音高上下文作为条件进行生成,并且可以无需重新训练地适应多种演唱任务。在各种演唱任务上的客观和主观评估表明,StylePitcher在风格相似性和音频质量方面均有所提高,而在与任务-specific baseline 相当的音准保持方面表现稳健。

关键词

引用

@article{arxiv.2510.21685,
  title  = {StylePitcher: Generating Style-Following and Expressive Pitch Curves for Versatile Singing Tasks},
  author = {Jingyue Huang and Qihui Yang and Fei Yueh Chen and Julian McAuley and Randal Leistikow and Perry R. Cook and Yongyi Zang},
  journal= {arXiv preprint arXiv:2510.21685},
  year   = {2025}
}

备注

Submitted to ICASSP 2026