d3rlpy:一个离线深度强化学习库
机器学习
2022-12-06 v2 人工智能
摘要
在本文中,我们介绍 d3rlpy,一个面向 Python 的开源离线深度强化学习(RL)库。d3rlpy 通过完备文档化的即插即用 API 支持一系列离线深度 RL 算法以及离策(off-policy)在线算法。为解决可复现性问题,我们使用 D4RL 和 Atari 2600 数据集进行了大规模基准测试,以确保实现质量,并提供了实验脚本与完整的结果表格。d3rlpy 源代码可在 GitHub 上找到:\url{https://github.com/takuseno/d3rlpy}。
引用
@article{arxiv.2111.03788,
title = {d3rlpy: An Offline Deep Reinforcement Learning Library},
author = {Takuma Seno and Michita Imai},
journal= {arXiv preprint arXiv:2111.03788},
year = {2022}
}
备注
Journal of Machine Learning Research