中文

无需再问:指称视觉对话中何时进行猜测的决策

计算与语言 2018-06-13 v2 计算机视觉与模式识别 多媒体

摘要

我们的目标在于探索如何将对话管理器带来的能力纳入端到端视觉接地对话智能体。我们朝这一总体目标迈出初步步伐:通过为任务导向的视觉对话模型增添一个决策组件,该组件决定是否提出后续问题以识别图像中的目标指称对象,或终止对话进行猜测。我们的分析表明,增添决策组件所产生的对话重复性更低、包含更少不必要问题,从而潜在地带来更高效且更自然的互动。

关键词

引用

@article{arxiv.1805.06960,
  title  = {Ask No More: Deciding when to guess in referential visual dialogue},
  author = {Ravi Shekhar and Tim Baumgartner and Aashish Venkatesh and Elia Bruni and Raffaella Bernardi and Raquel Fernandez},
  journal= {arXiv preprint arXiv:1805.06960},
  year   = {2018}
}

备注

COLING 2018 (accepted)