中文

最优 LZ-End 解析是困难的

数据结构与算法 2023-02-07 v1

摘要

LZ-End 是著名的 Lempel-Ziv 解析族的一种变体,要求解析中的每个短语都有前一次出现,并附加约束该前一次出现必须在前一个短语的结尾处结束。LZ-End 最初被提出时是一种贪心解析,其中每个短语从左到右贪心地确定为满足上述约束的最长因子~[Kreft & Navarro, 2010]。在本文中,我们考虑在所有此类解析中具有最少短语数的最优 LZ-End 解析。我们通过从顶点覆盖问题进行归约,证明了计算最优 LZ-End 解析的判定版本是 NP 完全的。此外,通过改编 [Bannai et al., 2022] 最近提出的用于计算各种 NP 困难重复性度量的方法,我们给出了最优 LZ-End 解析的 MAX-SAT 公式表示。我们还考虑了贪心 LZ-End 解析大小与最优 LZ-End 解析大小之间的近似比,并给出了该比率的渐近逼近 22 的下界。

关键词

引用

@article{arxiv.2302.02586,
  title  = {Optimal LZ-End Parsing is Hard},
  author = {Hideo Bannai and Mitsuru Funakoshi and Kazuhiro Kurita and Yuto Nakashima and Kazuhisa Seto and Takeaki Uno},
  journal= {arXiv preprint arXiv:2302.02586},
  year   = {2023}
}