有意无意(IU)智能体:学习同时解决多个连续控制任务
人工智能
2017-07-12 v1
摘要
本文介绍了有意无意(IU)智能体。该智能体赋予用于连续控制的深度确定性策略梯度(DDPG)智能体同时解决多个任务的能力。学习同时解决许多任务一直是人工智能的一个长期核心目标,其受到婴儿发展的启发,并出于构建能够执行多种不同行为的灵活机器人操纵器的愿望所驱动。我们表明,IU智能体不仅学会同时解决多个任务,而且比一次针对单个任务的智能体学习得更快。在某些情况下,单任务DDPG方法完全失败,而IU智能体成功解决了任务。为了证明这一点,我们使用MuJoCo物理引擎构建了一个游戏室环境,并引入了一种接地形式语言来自动生成任务。
引用
@article{arxiv.1707.03300,
title = {The Intentional Unintentional Agent: Learning to Solve Many Continuous Control Tasks Simultaneously},
author = {Serkan Cabi and Sergio Gómez Colmenarejo and Matthew W. Hoffman and Misha Denil and Ziyu Wang and Nando de Freitas},
journal= {arXiv preprint arXiv:1707.03300},
year = {2017}
}