中文

基于定位的连续语音分离序贯分组方法

声音 2021-07-15 v1 音频与语音处理

摘要

本研究探讨了面向连续语音分离与说话人日志的鲁棒说话人定位,利用说话人方向对同一个说话人的非连续片段进行分组。假设说话人静止且位于不同方向,则到达方向(DOA)信息为准确的序贯分组与说话人日志提供了有效线索。我们的系统具有以下块在线特性:给定最多包含两个说话人的一帧块,我们应用双说话人分离模型分离(并增强)说话人,估计每个分离说话人的 DOA,并基于 DOA 估计跨块对分离结果进行分组。在 LibriCSS 语料库上的说话人日志与说话人属性语音识别结果证明了所提算法的有效性。

关键词

引用

@article{arxiv.2107.06853,
  title  = {Localization Based Sequential Grouping for Continuous Speech Separation},
  author = {Zhong-Qiu Wang and DeLiang Wang},
  journal= {arXiv preprint arXiv:2107.06853},
  year   = {2021}
}

备注

5 pages, 1 figure