中文

d3rlpy:一个离线深度强化学习库

机器学习 2022-12-06 v2 人工智能

摘要

在本文中,我们介绍 d3rlpy,一个面向 Python 的开源离线深度强化学习(RL)库。d3rlpy 通过完备文档化的即插即用 API 支持一系列离线深度 RL 算法以及离策(off-policy)在线算法。为解决可复现性问题,我们使用 D4RL 和 Atari 2600 数据集进行了大规模基准测试,以确保实现质量,并提供了实验脚本与完整的结果表格。d3rlpy 源代码可在 GitHub 上找到:\url{https://github.com/takuseno/d3rlpy}。

关键词

引用

@article{arxiv.2111.03788,
  title  = {d3rlpy: An Offline Deep Reinforcement Learning Library},
  author = {Takuma Seno and Michita Imai},
  journal= {arXiv preprint arXiv:2111.03788},
  year   = {2022}
}

备注

Journal of Machine Learning Research