中文

超声舌成像中换能器失准的量化

音频与语音处理 2020-08-07 v1 声音

摘要

在言语产生研究中,已采用不同成像模态以获取关于声道运动与形状的准确信息。超声是一种经济且非侵入性的成像模态,具有相对较高的时间与空间分辨率,可用于研究言语产生过程中舌的动态行为。然而,超声舌成像的一个长期问题是较长时间数据采集会话期间的换能器失准。本文提出一种简单而有效的失准量化方法。该分析采用 MSE 距离与两种相似性度量指标来识别下巴与换能器之间的相对位移。我们将这些度量作为语句时间戳的函数进行可视化。在匈牙利语与苏格兰英语儿童数据集上进行了大量实验。结果表明,均方误差 (MSE) 的大值与结构相似性指数 (SSIM) 及复小波 SSIM 的小值指示数据采集过程中的损坏或问题,其可能由换能器失准或耦合剂不足引起。

关键词

引用

@article{arxiv.2008.02470,
  title  = {Quantification of Transducer Misalignment in Ultrasound Tongue Imaging},
  author = {Tamás Gábor Csapó and Kele Xu},
  journal= {arXiv preprint arXiv:2008.02470},
  year   = {2020}
}

备注

5 pages, accepted for publication at Interspeech 2020