中文

利用语音内瞬时呼吸特征进行说话人与姿态分类

声音 2020-05-26 v1 机器学习 音频与语音处理

摘要

从语音提取的声学特征广泛用于生物特征说话人识别与第一人称活动检测等问题。然而,将语音用于此类目的会引发隐私问题,因为处理方可得知内容。本工作中,我们提出一种利用语音内呼吸声进行说话人与姿态分类的方法。使用希尔伯特-黄变换(HHT)提取瞬时幅度特征,并输入CNN-GRU网络,对我们为此研究采集的开放语音内呼吸声数据集BreathBase中的录音进行分类。利用语音内呼吸声,获得了87%的说话人分类与98%的姿态分类准确率。

关键词

引用

@article{arxiv.2005.12230,
  title  = {Speaker and Posture Classification using Instantaneous Intraspeech Breathing Features},
  author = {Atıl İlerialkan and Alptekin Temizel and Hüseyin Hacıhabiboğlu},
  journal= {arXiv preprint arXiv:2005.12230},
  year   = {2020}
}

备注

5 pages, 3 figures