中文

基于 N-Gram 索引从迹前缀高效在线计算业务流程状态

软件工程 2025-05-19 v2

摘要

本文解决了以下问题:给定一个流程模型和一个包含正在进行的流程案例的迹前缀的事件日志,将每个案例映射到其在模型中相应的状态(即标识)。这种状态计算操作是其他流程挖掘操作(如日志动画和短期仿真)的基础模块。解决此状态计算问题的一种方法是对每个迹前缀针对模型执行基于令牌的重放。然而,当迹前缀未严格遵循流程模型的行为时,令牌重放可能会产生从流程初始状态无法到达的状态。另一种替代方法是首先计算每个正在进行的案例的迹前缀与模型之间的对齐,然后重放对齐后的迹前缀。然而,(前缀)对齐的计算成本很高。本文提出了一种方法,给定一个正在进行的案例的迹前缀,使用一个将状态表示为 n-gram 的索引在常数时间内计算其状态。实证评估表明,所提出的方法具有与前缀对齐方法相当的准确度,同时实现了每秒数十万条迹的吞吐量。

关键词

引用

@article{arxiv.2409.05658,
  title  = {Efficient Online Computation of Business Process State From Trace Prefixes via N-Gram Indexing},
  author = {David Chapela-Campa and Marlon Dumas},
  journal= {arXiv preprint arXiv:2409.05658},
  year   = {2025}
}

备注

Postprint version. Full version available at: https://doi.org/10.1109/TSC.2025.3547235