人工通用智能:基于强化学习掌握 Generals.io
机器学习
2025-07-11 v2 人工智能
摘要
我们介绍了一个基于 Generals.io 的实时策略游戏环境,Generals.io 是一款拥有数千名每周活跃玩家的游戏。我们的环境完全兼容 Gymnasium 和 PettingZoo,可在普通硬件上运行数千帧每秒。我们还提出了一个参考智能体,通过监督预训练和自我对弈训练,仅用 36 小时即可在单块 H100 GPU 上达到 1v1 人类排行榜前 0.003% 的水平。为加速学习,我们采用基于潜在的奖励塑形和记忆特征。我们提供的模块化 RTS 基准和竞争性基线智能体,为多智能体强化学习研究提供了一个易于访问 yet 有挑战性的平台。文档代码、示例和教程均已发布于 https://github.com/strakam/generals-bots。
引用
@article{arxiv.2507.06825,
title = {Artificial Generals Intelligence: Mastering Generals.io with Reinforcement Learning},
author = {Matej Straka and Martin Schmid},
journal= {arXiv preprint arXiv:2507.06825},
year = {2025}
}