中文

DSTC7 上的音视觉场景感知对话(AVSD)挑战赛

计算与语言 2018-06-05 v1 计算机视觉与模式识别

摘要

场景感知对话系统将能够与用户就周围的物体和事件进行对话。通过整合来自多个研究领域的先进技术,包括端到端对话系统、视觉对话和视频描述,可以推动此类系统的进展。我们介绍了音视觉场景感知对话(Audio Visual Scene Aware Dialog, AVSD)挑战赛及其数据集。在本挑战赛中——作为第七届对话系统技术挑战赛(DSTC7)研讨会的一个赛道——任务是构建一个针对输入视频进行对话并生成回复的系统。

关键词

引用

@article{arxiv.1806.00525,
  title  = {Audio Visual Scene-Aware Dialog (AVSD) Challenge at DSTC7},
  author = {Huda Alamri and Vincent Cartillier and Raphael Gontijo Lopes and Abhishek Das and Jue Wang and Irfan Essa and Dhruv Batra and Devi Parikh and Anoop Cherian and Tim K. Marks and Chiori Hori},
  journal= {arXiv preprint arXiv:1806.00525},
  year   = {2018}
}