在音频数据处理中应用子序列匹配
声音
2012-04-13 v1 数据库
摘要
我们概述了音频检索和时间序列子序列匹配当前的面临的问题。我们讨论了子序列匹配方法在音频数据处理中的应用,特别是在自动语音识别 (ASR) 领域,旨在提高检索过程的性能。为了克服时间序列领域中已知的问题,如实现偏差和数据偏差的出现,我们提出了一个子序列匹配框架,作为快速原型设计、构建和测试相似搜索子序列匹配应用的工具。该框架构建于 MESSIF(度量相似性搜索实现框架)之上,因此子序列匹配算法可以利用先进的相似性索引,从而显著提高查询处理性能。为了验证我们的概念,我们设计了一种基于示例查询的口语词检测类型应用,该应用使用了音素后验图 (phonetic posteriograms) 和子序列匹配方法。
引用
@article{arxiv.1204.2541,
title = {Employing Subsequence Matching in Audio Data Processing},
author = {Petr Volny and David Novak and Pavel Zezula},
journal= {arXiv preprint arXiv:1204.2541},
year = {2012}
}