基于 Hamming 距离的字符串相似性度量
代数拓扑
2022-11-29 v1
摘要
本文中,我们考虑以 Hamming 距离与持久同调工具为基础构建的两组字符串之间的相似性度量。首先我们描述附属于字符串集合的 Čech 过滤的构造、对应于该过滤的持久模及其条形码结构。利用这些手段,我们引入了一种针对两组字符串的新颖相似性度量,其基于对其同维条形码中条形的比较。我们的想法是寻求一种比较,其不仅考虑条形的重叠,还确保所观测条形在定性上相匹配,即它们代表相似的同调特征。为实现此想法,我们开发了称为单形半径分离技术的方法。
引用
@article{arxiv.2211.14615,
title = {Measures of string similarities based on the Hamming distance},
author = {Bojan Nikolić and Boris Šobot},
journal= {arXiv preprint arXiv:2211.14615},
year = {2022}
}