中文

通过强化学习动态设计高效且公平的人道主义供应链

机器学习 2025-05-26 v1 人工智能

摘要

本研究通过使用强化学习(PPO)动态设计高效且公平的人道主义供应链,并与启发式算法进行了比较。本研究证明PPO模型始终将平均满意度作为优先目标。

关键词

引用

@article{arxiv.2505.17439,
  title  = {Designing an efficient and equitable humanitarian supply chain dynamically via reinforcement learning},
  author = {Weijia Jin},
  journal= {arXiv preprint arXiv:2505.17439},
  year   = {2025}
}