Pok\'eAI:用于Pokemon Red的目标生成、战斗优化多智能体系统
人工智能
2025-07-01 v1 多智能体系统
摘要
我们介绍Pok\'eAI——首个面向Pokemon Red的文本化、多智能体大语言模型(LLM)框架,能够自主玩through并推进游戏进程。该系统由三类专职智能体构成:规划智能体、执行智能体和批判智能体,每个智能体都拥有自己的记忆库、角色和技能集合。规划智能体作为中枢大脑,生成推进游戏进程的任务;这些任务随后被委托给执行智能体,在游戏环境中执行。任务完成后,批判智能体对结果进行评估,以确定目标是否成功实现。完成验证后,控制权返回给规划智能体,形成闭环决策系统。作为初步步骤,我们在执行智能体中开发了一个战斗模块。我们的结果表明,战斗AI在50场野生对战中实现了80.8%的平均胜率,仅比经验丰富的玩家水平低出6%。此外,我们发现战斗表现与LLM在语言相关任务中的Arena评分之间存在强烈相关性,这表明语言能力与战略推理之间存在有意义的联系。最后,我们对游戏日志进行分析,发现每个LLM都呈现出独特的游戏风格,这表明 individual 模型会发展出不同的战略行为。
引用
@article{arxiv.2506.23689,
title = {Pok\'eAI: A Goal-Generating, Battle-Optimizing Multi-agent System for Pokemon Red},
author = {Zihao Liu and Xinhang Sui and Yueran Song and Siwen Wang},
journal= {arXiv preprint arXiv:2506.23689},
year = {2025}
}