基于三阶段框架的情感说话环境下的说话人确认
声音
2018-04-03 v1 音频与语音处理
摘要
本工作致力于引入、执行并评估一种三阶段说话人确认框架,以提升情感说话环境下退化的说话人确认性能。我们的框架由三个级联阶段组成:性别识别阶段,其后为情感识别阶段,再后为说话人确认阶段。所提框架在两个不同且独立的情感语音数据集上进行了评估:我们采集的数据集与Emotional Prosody Speech and Transcripts数据集。我们的结果表明,基于性别线索与情感线索的说话人确认优于仅基于性别线索、仅基于情感线索以及既无性别线索也无情感线索的说话人确认。基于所建议方法取得的平均说话人确认性能与人工听者主观评估所得非常相近。
引用
@article{arxiv.1804.00155,
title = {Speaker Verification in Emotional Talking Environments based on Three-Stage Framework},
author = {Ismail Shahin},
journal= {arXiv preprint arXiv:1804.00155},
year = {2018}
}
备注
5 pages, 1 figure, conference