中文

RLLTE:强化学习的长期演进项目

人工智能 2024-12-06 v2 机器学习

摘要

我们提出 RLLTE:一个用于强化学习(RL)研究与应用的长期演进、极度模块化且开源的框架。除提供一流算法实现外,RLLTE 亦作为开发算法的工具包。更具体地,RLLTE 从利用-探索角度彻底解耦 RL 算法,提供大量组件以加速算法开发与演进。特别地,RLLTE 是首个构建综合生态系统的 RL 框架,涵盖模型训练、评估、部署、基准中心,以及大语言模型(LLM)赋能的 copilot。RLLTE 有望为 RL 工程实践设立标准,并对工业界与学术界极具推动作用。我们的文档、示例与源代码见于 https://github.com/RLE-Foundation/rllte。

关键词

引用

@article{arxiv.2309.16382,
  title  = {RLLTE: Long-Term Evolution Project of Reinforcement Learning},
  author = {Mingqi Yuan and Zequn Zhang and Yang Xu and Shihao Luo and Bo Li and Xin Jin and Wenjun Zeng},
  journal= {arXiv preprint arXiv:2309.16382},
  year   = {2024}
}

备注

Proceedings of the AAAI Conference on Artificial Intelligence, 2025