面向复合场景理解的符号图推理
计算机视觉与模式识别
2024-10-31 v1
摘要
场景理解是从问答到机器人等许多领域所需的一项基本能力。与必须显式学习同一场景的不同组合的近期端到端方法不同,我们的方法对其构成对象进行推理,并分析它们的排列以推断场景的含义。我们提出了一种新颖的方法,该方法对场景的场景图和知识图进行推理,捕获空间信息,同时能够在联合图搜索中利用通用领域知识。通过实验,我们在 ADE20K 数据集上证明了我们方法的可行性,并将其与当前的场景理解方法进行了比较。
引用
@article{arxiv.2410.22626,
title = {Symbolic Graph Inference for Compound Scene Understanding},
author = {FNU Aryan and Simon Stepputtis and Sarthak Bhagat and Joseph Campbell and Kwonjoon Lee and Hossein Nourkhiz Mahjoub and Katia Sycara},
journal= {arXiv preprint arXiv:2410.22626},
year = {2024}
}