中文

地铁站中虚拟声学场景的通信条件

声音 2025-09-15 v2 音频与语音处理

摘要

地铁站是城市中常见的通信场景:我们在背景噪声和混响对通信造成挑战的同时,与朋友或同事交谈、听取广播或购买零碎物品。在此,我们对慕尼黑一座地铁站中的两个通信场景进行声学分析并测试语音可懂度。在站中测量了声学条件,并与实时模拟开放场环境(rtSOFE)中的仿真进行比较。我们将用人工头在站中测量的双耳房间脉冲响应,与通过rtSOFE中60个 loudspeaker 进行自由场可听化建模的脉冲响应进行比较。我们使用镜像源法建模早期反射,并使用一组多麦克风录音建模后期混响。第一个通信场景由听者周围12个等距(1.6 m)水平间隔的声源位置组成,模拟不同的方向相关空间去掩蔽条件。第二个场景模拟一个接近的说话者跨越六个径向间隔的声源位置(从1 m到10 m),具有变化的直达声级从而具有不同的直达与混响能量比。地铁站的声学参数显示出中等程度的混响(倍频带中T30介于2.3 s和0.6 s之间,早期衰减时间介于1.46 s和0.46 s之间)。可听化的双耳与能量参数与测量结果紧密吻合。测得的语音接收阈在语音测试误差范围内,使我们得出结论:可听化仿真以高精度复现了与语音可懂度相关的声学和感知相关参数。

关键词

引用

@article{arxiv.2106.15916,
  title  = {Communication conditions in virtual acoustic scenes in an underground station},
  author = {Ľuboš Hládek and Stephan D. Ewert and Bernhard U. Seeber},
  journal= {arXiv preprint arXiv:2106.15916},
  year   = {2025}
}

备注

I3DA conference paper, 8 figures, 9 pages