中文

基于 Hamming 距离的字符串相似性度量

代数拓扑 2022-11-29 v1

摘要

本文中,我们考虑以 Hamming 距离与持久同调工具为基础构建的两组字符串之间的相似性度量。首先我们描述附属于字符串集合的 Čech 过滤的构造、对应于该过滤的持久模及其条形码结构。利用这些手段,我们引入了一种针对两组字符串的新颖相似性度量,其基于对其同维条形码中条形的比较。我们的想法是寻求一种比较,其不仅考虑条形的重叠,还确保所观测条形在定性上相匹配,即它们代表相似的同调特征。为实现此想法,我们开发了称为单形半径分离技术的方法。

关键词

引用

@article{arxiv.2211.14615,
  title  = {Measures of string similarities based on the Hamming distance},
  author = {Bojan Nikolić and Boris Šobot},
  journal= {arXiv preprint arXiv:2211.14615},
  year   = {2022}
}