中文

VADet:基于可变聚合的多帧激光点云3D目标检测

计算机视觉与模式识别 2024-11-21 v1

摘要

输入聚合是当前领先激光点云3D目标检测器中用于提升检测性能的简单技术。然而,随着聚合帧数的增加,已知会出现收益递减甚至性能下降,这是由于不同目标对聚合帧数的响应不同所致。为解决这一限制,我们提出一种高效的自适应方法,称为可变聚合检测(Variable Aggregation Detection,VADet)。VADet不同于固定聚合整个场景的帧数,而是对每个目标单独进行聚合,其聚合帧数由目标观察到的属性(如速度和点密度)决定。因此,VADet消除了固定聚合固有的权衡问题,且不依赖于特定网络架构。为展示其优势,我们将VADet应用于三种流行的单阶段检测器,并在Waymo数据集上实现了最先进的性能。

关键词

引用

@article{arxiv.2411.13186,
  title  = {VADet: Multi-frame LiDAR 3D Object Detection using Variable Aggregation},
  author = {Chengjie Huang and Vahdat Abdelzad and Sean Sedwards and Krzysztof Czarnecki},
  journal= {arXiv preprint arXiv:2411.13186},
  year   = {2024}
}

备注

Accepted by WACV 2025