面向交互式指令遵循的感知与策略分解
人工智能
2021-09-03 v3 计算机视觉与模式识别
机器人学
摘要
基于语言指令执行简单的家务任务对人类而言非常自然,但对AI智能体来说仍是一项开放挑战。'交互式指令遵循'任务试图在构建能够每一步都在环境中联合导航、交互和推理的智能体方面取得进展。为解决这一多方面问题,我们提出了一种将任务分解为交互式感知与动作策略流并带有增强组件的模型,并将其命名为MOCA,即一种模块化以对象为中心的方法(Modular Object-Centric Approach)。我们经实证验证,MOCA在ALFRED基准上以显著提升的泛化能力优于先前的方法。
引用
@article{arxiv.2012.03208,
title = {Factorizing Perception and Policy for Interactive Instruction Following},
author = {Kunal Pratap Singh and Suvaansh Bhambri and Byeonghwi Kim and Roozbeh Mottaghi and Jonghyun Choi},
journal= {arXiv preprint arXiv:2012.03208},
year = {2021}
}
备注
ICCV 2021