在Wheeler DFA上计算匹配统计量
数据结构与算法
2023-01-16 v1
摘要
匹配统计量被引入用于解决近似字符串匹配问题,这是生物信息学应用中一个反复出现的子程序。2010年,Ohlebusch等人[SPIRE 2010]提出了一种时间和空间高效的算法来计算匹配统计量,该算法依赖于压缩后缀树的一些组件——特别是最长公共前缀(LCP)数组。在本文中,我们展示了如何将他们的算法从字符串推广到Wheeler确定性有限自动机。最重要的是,我们为Wheeler自动机引入了LCP数组的概念,从而为将(压缩)后缀树的功能扩展到带标签的图迈出了明确的第一步。
引用
@article{arxiv.2301.05338,
title = {Computing matching statistics on Wheeler DFAs},
author = {Alessio Conte and Nicola Cotumaccio and Travis Gagie and Giovanni Manzini and Nicola Prezza and Marinella Sciortino},
journal= {arXiv preprint arXiv:2301.05338},
year = {2023}
}