LZ77 型解析的比较
信息论
2018-05-24 v3 math.IT
摘要
我们研究了文献中现有的不同 LZ77 解析变体之间的关系。所有这些变体均被定义为贪心构造的解析,通过引用输入中较早出现的字符串来编码每个短语。它们的区别在于短语编码方式:由对(长度 + 较早出现的位置)编码,或由三元组(长度 + 较早出现的位置 + 较早出现部分之后的字母)编码;以及是否允许短语与其较早出现部分之间存在重叠。对于大小为 的字母表上长度为 的给定字符串,用 (分别地,)表示允许(分别地,不允许)重叠的“对”解析中的短语数,用 (分别地,)表示“三元组”解析中的短语数。我们证明了以下界限,并提供了一系列示例表明这些界限是紧的: 且 ; 且 。
引用
@article{arxiv.1708.03558,
title = {Comparison of LZ77-type Parsings},
author = {Dmitry Kosolobov and Arseny M. Shur},
journal= {arXiv preprint arXiv:1708.03558},
year = {2018}
}
备注
6 pages