PAS-SE:面向听戴设备的个人化辅助传感器语音增强
音频与语音处理
2026-02-05 v2
摘要
语音增强旨在抑制噪声和干扰说话人,同时保持自语质量。单通道方法在无额外上下文信息时难以区分目标语与干扰语。本文比较了两种解决策略:个人化语音增强(PSE)利用注册语表示目标语,辅助传感器语音增强(AS-SE)利用入耳麦克风作为额外输入。我们在两个公开数据集上评估这些策略,采用不同类型的辅助传感器阵列,探讨其跨数据集的泛化性。我们提出的训练时数据增强有助于提升 AS-SE 系统的跨数据集泛化。我们还表明,结合 PSE 与 AS-SE(PAS-SE)可提供互补的性能提升,尤其在目标语随入耳麦克风录制时效果更佳。进一步表明,即使使用含噪注册语,PAS-SE 仍能为 AS-SE 系统带来性能优势。
引用
@article{arxiv.2509.20875,
title = {PAS-SE: Personalized Auxiliary-Sensor Speech Enhancement for Voice Pickup in Hearables},
author = {Mattes Ohlenbusch and Mikolaj Kegler and Marko Stamenovic},
journal= {arXiv preprint arXiv:2509.20875},
year = {2026}
}
备注
Accepted to ICASSP 2026