中文

SHARPIE:用于强化学习与人机交互实验的模块化框架

人工智能 2025-02-04 v2 人机交互

摘要

强化学习为建模和训练 AI 智能体提供了一种通用方法,包括人机交互场景。在本文中,我们提出 SHARPIE(用于交互实验的共享人机强化学习平台),以满足对支持 RL 智能体与人类实验的通用框架的需求。其模块化设计包含一个用于 RL 环境和算法库的通用封装、面向参与者的网络界面、日志记录工具,以及在流行云平台和参与者招募平台上的部署。它使研究人员能够研究各种与人类和 RL 智能体交互相关的研究问题,包括交互式奖励规范与学习、从人类反馈中学习、动作委托、偏好诱导、用户建模和人机协作。该平台基于人机交互的通用界面,旨在标准化人类情境下 RL 的研究领域。

关键词

引用

@article{arxiv.2501.19245,
  title  = {SHARPIE: A Modular Framework for Reinforcement Learning and Human-AI Interaction Experiments},
  author = {Hüseyin Aydın and Kevin Godin-Dubois and Libio Goncalvez Braz and Floris den Hengst and Kim Baraka and Mustafa Mert Çelikok and Andreas Sauter and Shihan Wang and Frans A. Oliehoek},
  journal= {arXiv preprint arXiv:2501.19245},
  year   = {2025}
}