中文

正则语言中单词后缀的常数时间动态枚举

形式语言与自动机理论 2026-02-17 v1 数据结构与算法

摘要

对于固定的正则语言 LL,后缀枚举如下任务:给定输入单词 w=a1anw = a_1 \cdots a_n,我们必须枚举属于 LL 的后缀,即满足 aiajLa_i \cdots a_j \in L 的下标对 (i,j)(i,j)。我们关注 LL-后缀的动态枚举,其中还需支持对 ww 的字母替换更新(例如"将第 ii 个字母替换为字母 aa")。每一次更新都会改变待枚举的后缀集合,并重置枚举状态。我们研究对于哪些正则语言 LL 可以在常数延迟下(即总是以常数时间产生下一个后缀)、常数额外存储空间下进行动态后缀枚举,同时支持每次更新在常数时间内完成。我们证明,对于具有中性字母的语言 LL,若语言 LL 属于 ZG 类且是可扩展的(即若 uLu \in Luuvv 的因子,则 vLv \in L),则可采用简单算法实现常数时间更新和常数延迟,但无法做到常数额外存储空间。我们的主要贡献是证明一个算法,该算法额外仅使用常数存储空间,适用于更广泛的半可扩展 ZG 语言类,并给出若干等价特征描述。我们进一步讨论了结果是否可推广至更大的语言类,并给出一些(条件性的)下界。

关键词

引用

@article{arxiv.2602.14748,
  title  = {Constant-Time Dynamic Enumeration of Word Infixes in a Regular Language},
  author = {Antoine Amarilli and Sven Dziadek and Luc Segoufin},
  journal= {arXiv preprint arXiv:2602.14748},
  year   = {2026}
}

备注

34 pages, 1 figure. Submitted