中文

一种用于对话式图像编辑的多模态对话系统

计算与语言 2020-02-18 v1

摘要

本文提出一种用于对话式图像编辑的多模态对话系统。我们将该多模态对话系统建模为部分可观测马尔可夫决策过程(POMDP),并使用深度Q网络(DQN)与用户模拟器进行训练。我们的评估表明,DQN策略优于基于规则的基线策略,在高错误率下达到90%成功率。我们还开展了真实用户研究并分析了真实用户行为。

关键词

引用

@article{arxiv.2002.06484,
  title  = {A Multimodal Dialogue System for Conversational Image Editing},
  author = {Tzu-Hsiang Lin and Trung Bui and Doo Soon Kim and Jean Oh},
  journal= {arXiv preprint arXiv:2002.06484},
  year   = {2020}
}

备注

Accepted at 2nd Conversational AI Workshop at NeurIPS 2018