HERO:用于可移动障碍物下的具象化导航的分层可遍历 3D 场景图
机器人学
2025-12-18 v1 人工智能
计算与语言
计算机视觉与模式识别
摘要
3D 场景图 (3DSG) 构成了对物理世界的强大表征,区别在于其能够显式建模实体之间复杂的空间、语义和功能关系,为智能体与环境交互及执行多样化行为提供了基础理解。具象化导航作为此类能力的关键组成部分,利用 3DSG 的紧凑且富有表现力的特性,使代理能够在复杂大规模环境中进行长程推理与规划。然而,先前工作依赖静态世界假设,仅基于静态空间布局定义可遍历空间,从而将可互动障碍物视为不可遍历,严重削弱了其在现实场景中的有效性,导致可达性有限、效率低下且可扩展性差。为此,我们提出 HERO,一种构建分层可遍历 3D 场景图的新框架,通过将可操作障碍物建模为通道,捕获其物理互动性、功能语义及场景关系层次,从而重新定义可遍历性。结果表明,相较于基线方法,HERO 在部分被阻挡环境中将 PL 降低 35.1%,在完全被阻挡环境中将 SR 提升 79.4%,显著提高了效率和可达性。
引用
@article{arxiv.2512.15047,
title = {HERO: Hierarchical Traversable 3D Scene Graphs for Embodied Navigation Among Movable Obstacles},
author = {Yunheng Wang and Yixiao Feng and Yuetong Fang and Shuning Zhang and Tan Jing and Jian Li and Xiangrui Jiang and Renjing Xu},
journal= {arXiv preprint arXiv:2512.15047},
year = {2025}
}