LayoutVAE:基于标签集的随机场景布局生成
计算机视觉与模式识别
2021-06-02 v3
摘要
近来研究界对场景生成的兴趣日益增加。然而,用于根据文本描述生成场景布局的模型在很大程度上忽略了文本所规定结构内合理的视觉变化。我们提出 LayoutVAE,一种基于变分自编码器的框架,用于生成随机场景布局。LayoutVAE 是一个通用的建模框架,允许在给定标签集的情况下生成完整图像布局,或针对现有图像在给定新标签时生成逐标签布局。此外,它还能够检测异常布局,潜在地为评估布局生成问题提供途径。在 MNIST-Layouts 和具有挑战性的 COCO 2017 Panoptic 数据集上的大量实验验证了我们所提出框架的有效性。
引用
@article{arxiv.1907.10719,
title = {LayoutVAE: Stochastic Scene Layout Generation From a Label Set},
author = {Akash Abdu Jyothi and Thibaut Durand and Jiawei He and Leonid Sigal and Greg Mori},
journal= {arXiv preprint arXiv:1907.10719},
year = {2021}
}
备注
20 pages, 24 figures, accepted in ICCV 2019