中文

有限重复的广义嵌套滚动策略自适应

人工智能 2024-01-22 v1

摘要

广义嵌套滚动策略自适应(GNRPA)是一种用于优化选择序列的蒙特卡洛搜索算法。我们建议通过避免过于确定性的策略(即反复找到相同选择序列的策略)来改进 GNRPA。我们通过限制在给定层级上找到的最佳序列的重复次数来实现这一点。实验表明,该改进在三个不同的组合问题上提升了算法性能:逆 RNA 折叠、带时间窗的旅行商问题和弱 Schur 问题。

关键词

引用

@article{arxiv.2401.10420,
  title  = {Generalized Nested Rollout Policy Adaptation with Limited Repetitions},
  author = {Tristan Cazenave},
  journal= {arXiv preprint arXiv:2401.10420},
  year   = {2024}
}