中文

桥接评估鸿沟:多目标搜索的标准化基准

人工智能 2026-03-26 v1

摘要

多目标搜索(MOS)的经验评估历史上因采用异构问题实例和不兼容的目标定义而存在碎片化问题,导致跨研究比较困难。这种标准化差距进一步因发现维度图(DIMACS)道路网络作为该领域历史默认基准,呈现高度相关目标,无法捕捉多样化的帕累托前沿结构。为此,我们引入首个全面、标准化的多目标搜索基准套件,覆盖 exact 与 approximate 方法。该套件涵盖四个结构上高度异样的领域:真实道路网络、结构化人造图、游戏式网格环境及高维机器人运动规划路网。通过提供固定图实例、标准化起点-终点查询及 exact 与 approximate 参考帕累托最优解集,此基准捕捉目标相互作用的完整谱系:从强相关到严格独立。最终,该基准为确保未来MOS评估具备稳健性、可重复性及结构完整性提供了共同基础。

关键词

引用

@article{arxiv.2603.24084,
  title  = {Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search},
  author = {Hadar Peer and Carlos Hernandez and Sven Koenig and Ariel Felner and Oren Salzman},
  journal= {arXiv preprint arXiv:2603.24084},
  year   = {2026}
}