Obj-GloVe:基于场景的上下文物体嵌入
计算机视觉与模式识别
2019-07-03 v1 机器学习
摘要
近年来,随着大规模图像数据集的普及,类别间的共现信息变得丰富,亟需一种新的方式来利用它以促进推断。本文提出 Obj-GloVe,一种面向常见视觉物体的通用基于场景的上下文嵌入,其中我们采用词嵌入方法 GloVe 来挖掘实体之间的共现关系。我们在预处理后的 Open Images V4 数据集上训练该嵌入,并通过降维、沿特定语义轴投影向量以及展示最常见物体的最近邻,提供广泛的可视化与分析。此外,我们揭示了 Obj-GloVe 在目标检测与文本到图像合成上的潜在应用,并分别在这两个应用上验证了其有效性。
引用
@article{arxiv.1907.01478,
title = {Obj-GloVe: Scene-Based Contextual Object Embedding},
author = {Canwen Xu and Zhenzhong Chen and Chenliang Li},
journal= {arXiv preprint arXiv:1907.01478},
year = {2019}
}
备注
14 pages; not the final version