欲速则不达:降低完全可索引字典中的冗余度
数据结构与算法
2009-02-17 v1
摘要
我们考虑以压缩格式表示一个包含个1的位比特向量的问题,支持以下操作,其中:返回前缀中比特的出现次数;返回中第个比特出现的位置。这种数据结构称为完全可索引字典(FID) [Raman et al., 2007],其功能至少与前驱数据结构相当。我们的重点是在字长为且所有操作时间为常数的\textsc{ram}模型上构建空间高效的FID,使得时间成本与输入大小无关。给定待编码的比特串,长度为且包含个1,需要存储的最小信息量为。为构建FID的最新成果见[Patrascu, 2008],使用比特,以时间支持操作。在此,我们提出一种参数化数据结构,展现出时间/空间权衡,使得对于任意实常数、和整数,它使用比特,并以时间执行所有操作。改进是双重的:我们的冗余度可以参数化地降低,并且固定时,对于足够大的,我们得到一个空间为比特的常数时间FID。与之前的一般情况界限相比,这是一个显著的改进。
引用
@article{arxiv.0902.2648,
title = {More Haste, Less Waste: Lowering the Redundancy in Fully Indexable Dictionaries},
author = {Roberto Grossi and Alessio Orlandi and Rajeev Raman and S. Srinivasa Rao},
journal= {arXiv preprint arXiv:0902.2648},
year = {2009}
}