在基于价值的深度强化学习中,剪枝网络即是优良网络
机器学习
2024-06-26 v3 人工智能
摘要
最近的工作表明,深度强化学习智能体难以有效利用其网络参数。我们利用关于稀疏训练技术优势的先前见解,并证明渐进幅度剪枝使基于价值的智能体能够最大化参数效率。这导致生成的网络仅使用全部网络参数的一小部分,却在性能上相较于传统网络取得了显著改进。
引用
@article{arxiv.2402.12479,
title = {In value-based deep reinforcement learning, a pruned network is a good network},
author = {Johan Obando-Ceron and Aaron Courville and Pablo Samuel Castro},
journal= {arXiv preprint arXiv:2402.12479},
year = {2024}
}