中文

ChatPainter: 利用对话改进文本到图像生成

计算机视觉与模式识别 2018-02-23 v1

摘要

在如 Microsoft Common Objects in Context (MS COCO) 这类每个图像可能包含多个对象的数据集上,从文本描述合成逼真图像是一项具有挑战性的任务。先前工作利用文本描述生成图像。然而,描述可能不足以捕捉整幅图像,且不足以让模型理解图像中哪些对象对应描述中的哪些词。我们表明,添加进一步描述场景的对话可在 MS COCO 数据集上显著提升初始分数(inception score)及生成图像的质量。

关键词

引用

@article{arxiv.1802.08216,
  title  = {ChatPainter: Improving Text to Image Generation using Dialogue},
  author = {Shikhar Sharma and Dendi Suhubdy and Vincent Michalski and Samira Ebrahimi Kahou and Yoshua Bengio},
  journal= {arXiv preprint arXiv:1802.08216},
  year   = {2018}
}