中文

跨视角几何精准生成式重建:填补视角间隙的鸿沟

计算机视觉与模式识别 2026-05-11 v1

摘要

3D 视觉系统根本受限于其对视觉重叠的依赖:重建方法需要视觉重叠以实现几何对齐,而生成模型则依赖视觉重叠以强制多视角一致性。这种限制在现实世界场景中尤为突出,例如分布式群体机器人或众包数据收集,其中捕获重叠视角(包括空间和外观重叠)往往不可能。我们提出了从 disjoint 视角进行生成式重建作为一种新范式,建立了全面的数据集,并为零重叠情形提出了专门的评估指标。我们的基准测试表明,现有最先进的方法在该任务上会 catastrophic 失败,产生不连贯的几何或语义不一致的重建。为解决这些限制,我们提出了 GLADOS,一个通用、模块化的框架,通过三个阶段运行:(1) 生成式桥接,其中基础模型合成中间视角以连接 disjoint 输入;(2) 稳健的粗糙 3D 重建,通过全局对齐建立粗糙几何骨架,以吸收来自生成过程的局部矛盾;(3) 迭代上下文扩张和一致性优化以填充缺失区域并统一重建。作为一个与体系结构无关的框架,GLADOS 使未来在生成、重建和图像填补方面的进展能够无缝集成。该源码可在 https://github.com/gwilczynski95/GLADOS 获取。

关键词

引用

@article{arxiv.2605.07550,
  title  = {Mind the Gap: Geometrically Accurate Generative Reconstruction from Disjoint Views},
  author = {Grzegorz Wilczynski and Mikołaj Zielinski and Bartosz Świrta and Dominik Belter and Przemysław Spurek},
  journal= {arXiv preprint arXiv:2605.07550},
  year   = {2026}
}