中文

说话人识别技术现状

音频与语音处理 2022-02-28 v1 机器学习 声音

摘要

语音技术的最新进展产生了新的工具,可用于提升说话人识别的性能与灵活性。在使用指纹或虹膜识别技术时,自由度或替代方法很少,而语音在识别时提供了更高的灵活性与不同层次:系统可强制用户以特定方式说话,且每次尝试进入时各不相同。同样,借助语音输入,系统还拥有其他自由度,例如使用仅用户知晓的知识/密码,或难以伪造的方言/语义特征。本文概述了说话人识别的技术现状,重点强调其优缺点及当前研究方向。当前研究方向包括改进的分类系统,以及通过概率文法利用高层信息。总之,说话人识别远未成为一种所有可能性均已被探索的技术。

关键词

引用

@article{arxiv.2202.12705,
  title  = {State-of-the-art in speaker recognition},
  author = {Marcos Faundez-Zanuy and Enric Monte-Moreno},
  journal= {arXiv preprint arXiv:2202.12705},
  year   = {2022}
}

备注

7 pages. arXiv admin note: text overlap with arXiv:2202.11459