中文

Go-Explore 的行为与情感融合

机器学习 2021-09-29 v1 人工智能 人机交互

摘要

本文提出一种情感计算范式转变,将情感建模任务视为强化学习过程。根据我们提出的框架,智能体(agent)的上下文(环境)与动作定义了交织行为与情感的共同表示。为实现该框架,我们基于强化学习的最新进展,使用了 Go-Explore 算法的改进版本,该算法在困难探索任务中展现出卓越性能。在这项初步研究中,我们于街机游戏中测试框架,训练 Go-Explore 智能体既进行最优博弈,又尝试模仿人类唤醒度(arousal)演示。我们调整最优博弈与唤醒度模仿之间的重要性程度,创造出能有效展现一系列情感与行为模式的智能体。我们的 Go-Explore 实现不仅引入了情感建模的新范式,还通过提供能够融合并表达多种行为与情感模式的智能体,赋能了可信的基于 AI 的游戏测试。

关键词

引用

@article{arxiv.2109.13388,
  title  = {Go-Blend behavior and affect},
  author = {Matthew Barthet and Antonios Liapis and Georgios N. Yannakakis},
  journal= {arXiv preprint arXiv:2109.13388},
  year   = {2021}
}

备注

8 pages