中文

面向复合场景理解的符号图推理

计算机视觉与模式识别 2024-10-31 v1

摘要

场景理解是从问答到机器人等许多领域所需的一项基本能力。与必须显式学习同一场景的不同组合的近期端到端方法不同,我们的方法对其构成对象进行推理,并分析它们的排列以推断场景的含义。我们提出了一种新颖的方法,该方法对场景的场景图和知识图进行推理,捕获空间信息,同时能够在联合图搜索中利用通用领域知识。通过实验,我们在 ADE20K 数据集上证明了我们方法的可行性,并将其与当前的场景理解方法进行了比较。

关键词

引用

@article{arxiv.2410.22626,
  title  = {Symbolic Graph Inference for Compound Scene Understanding},
  author = {FNU Aryan and Simon Stepputtis and Sarthak Bhagat and Joseph Campbell and Kwonjoon Lee and Hossein Nourkhiz Mahjoub and Katia Sycara},
  journal= {arXiv preprint arXiv:2410.22626},
  year   = {2024}
}