中文

VIN:基于体素的隐式网络用于激光雷达联合三维目标检测与分割

计算机视觉与模式识别 2021-11-16 v2

摘要

本文提出了一种统一的神经网络结构,用于联合三维目标检测与点云分割。我们利用来自检测与分割标签的丰富监督,而非仅使用其中之一。此外,基于广泛用于三维场景与物体理解的隐式函数,提出了一种基于单阶段目标检测器的扩展。该扩展分支以目标检测模块的最终特征图作为输入,并产生一个隐式函数,为其对应体素中心的每个点生成语义分布。我们在大规模室外数据集 nuScenes-lidarseg 上展示了我们结构的性能。相较于目标检测方案,我们的解决方案在三维目标检测与点云分割上均以极小的额外计算负载取得了媲美当前最优(SOTA)方法的竞争结果。所提方法的高效弱监督语义分割能力也通过实验得到验证。

关键词

引用

@article{arxiv.2107.02980,
  title  = {VIN: Voxel-based Implicit Network for Joint 3D Object Detection and Segmentation for Lidars},
  author = {Yuanxin Zhong and Minghan Zhu and Huei Peng},
  journal= {arXiv preprint arXiv:2107.02980},
  year   = {2021}
}

备注

To be presented at BMVC 2021