基于相对传递函数的端到端多麦克风说话人提取
声音
2025-02-11 v1 人工智能
摘要
本文介绍了一种用于从涉及多个说话人和方向性噪声的混合信号中提取目标说话人的多麦克风方法,适用于存在混响环境的场景。本文中,我们提出了利用从与目标源相同位置记录的参考语音中估计的瞬时相对传递函数(RTF),的方法。将 RTF 基于的空间线索与方向到达(DOA)基于的空间线索和传统谱嵌入进行比较。实验结果在具有挑战性的声学场景中表明,使用空间线索的性能优于基于谱的线索,且瞬时 RTF 在 DOA 基于的空间线索方面表现更佳。
引用
@article{arxiv.2502.06285,
title = {End-to-End Multi-Microphone Speaker Extraction Using Relative Transfer Functions},
author = {Aviad Eisenberg and Sharon Gannot and Shlomo E. Chazan},
journal= {arXiv preprint arXiv:2502.06285},
year = {2025}
}