中文

拟声词到波形:基于拟声词的环境声音合成

声音 2022-02-08 v4 音频与语音处理

摘要

在本文中,我们提出了一个从拟声词合成环境声音的框架。作为表达环境声音的一种方式,我们可以使用拟声词,即用于语音模仿声音的字符序列。拟声词对于描述多样的声音特征十分有效。因此,使用拟声词进行环境声音合成将使我们能够生成多样的环境声音。为了生成多样的声音,我们提出了一种基于序列到序列框架的方法,用于从拟声词合成环境声音。我们还提出了一种利用拟声词和声音事件标签进行环境声音合成的方法。除拟声词外还使用声音事件标签,使我们能够根据输入的声音事件标签捕捉每个声音事件的特征。我们的主观实验表明,与传统的利用声音事件标签的方法相比,我们提出的方法实现了更高的多样性和自然度。

关键词

引用

@article{arxiv.2102.05872,
  title  = {Onoma-to-wave: Environmental sound synthesis from onomatopoeic words},
  author = {Yuki Okamoto and Keisuke Imoto and Shinnosuke Takamichi and Ryosuke Yamanishi and Takahiro Fukumori and Yoichi Yamashita},
  journal= {arXiv preprint arXiv:2102.05872},
  year   = {2022}
}

备注

Accepted to APSIPA Transactions on Signal and Information Processing