Go-Explore 的行为与情感融合
机器学习
2021-09-29 v1 人工智能
人机交互
摘要
本文提出一种情感计算范式转变,将情感建模任务视为强化学习过程。根据我们提出的框架,智能体(agent)的上下文(环境)与动作定义了交织行为与情感的共同表示。为实现该框架,我们基于强化学习的最新进展,使用了 Go-Explore 算法的改进版本,该算法在困难探索任务中展现出卓越性能。在这项初步研究中,我们于街机游戏中测试框架,训练 Go-Explore 智能体既进行最优博弈,又尝试模仿人类唤醒度(arousal)演示。我们调整最优博弈与唤醒度模仿之间的重要性程度,创造出能有效展现一系列情感与行为模式的智能体。我们的 Go-Explore 实现不仅引入了情感建模的新范式,还通过提供能够融合并表达多种行为与情感模式的智能体,赋能了可信的基于 AI 的游戏测试。
引用
@article{arxiv.2109.13388,
title = {Go-Blend behavior and affect},
author = {Matthew Barthet and Antonios Liapis and Georgios N. Yannakakis},
journal= {arXiv preprint arXiv:2109.13388},
year = {2021}
}
备注
8 pages