通过强化学习动态设计高效且公平的人道主义供应链
机器学习
2025-05-26 v1 人工智能
摘要
本研究通过使用强化学习(PPO)动态设计高效且公平的人道主义供应链,并与启发式算法进行了比较。本研究证明PPO模型始终将平均满意度作为优先目标。
引用
@article{arxiv.2505.17439,
title = {Designing an efficient and equitable humanitarian supply chain dynamically via reinforcement learning},
author = {Weijia Jin},
journal= {arXiv preprint arXiv:2505.17439},
year = {2025}
}