中文

学习型多模态压缩用于自动驾驶

图像与视频处理 2024-08-16 v1 计算机视觉与模式识别

摘要

自动驾驶传感器生成海量数据。本文探索面向自动驾驶的学习型多模态压缩,专门针对三维目标检测。我们聚焦相机与激光雷达模态,并探索多种编码方案。其中一种方案涉及融合模态的联合编码,而其他方案则涉及先对一种模态进行编码,随后对另一种模态进行条件编码。我们在 nuScenes 数据集上评估了这些编码方案的性能。实验结果表明,融合模态的联合编码相较于替代方案能够取得更好的结果。

关键词

引用

@article{arxiv.2408.08211,
  title  = {Learned Multimodal Compression for Autonomous Driving},
  author = {Hadi Hadizadeh and Ivan V. Bajić},
  journal= {arXiv preprint arXiv:2408.08211},
  year   = {2024}
}

备注

6 pages, 5 figures, IEEE MMSP 2024