HoME:一种家用多模态环境
人工智能
2017-11-30 v1 计算与语言
计算机视觉与模式识别
机器人学
声音
音频与语音处理
摘要
我们介绍 HoME:一种家用多模态环境(Household Multimodal Environment),供人工智能体在真实情境中从视觉、听觉、语义、物理以及与物体和其他智能体的交互中学习。HoME 基于 SUNCG 数据集集成了超过 45,000 个多样化的三维房屋布局,这一规模有助于学习、泛化与迁移。HoME 是一个开源的、兼容 OpenAI Gym 的平台,可扩展至强化学习、语言接地、基于声音的导航、机器人学、多智能体学习等任务。我们希望 HoME 能更好地使人工智能体像人类一样学习:在交互式、多模态且丰富情境化的环境中。
引用
@article{arxiv.1711.11017,
title = {HoME: a Household Multimodal Environment},
author = {Simon Brodeur and Ethan Perez and Ankesh Anand and Florian Golemo and Luca Celotti and Florian Strub and Jean Rouat and Hugo Larochelle and Aaron Courville},
journal= {arXiv preprint arXiv:1711.11017},
year = {2017}
}
备注
Presented at NIPS 2017's Visually-Grounded Interaction and Language Workshop