中文

NanoMVG:基于提示引导相机与4D毫米波雷达的以无人艇为中心的低功耗多任务视觉定位

计算机视觉与模式识别 2025-02-13 v2 机器人学

摘要

近期,视觉定位与多传感器设置已被纳入陆地自动驾驶系统和无人水面艇(USV)的感知系统中,然而基于多传感器的现代学习型视觉定位模型复杂度过高,阻碍了此类模型在现实中的无人水面艇上部署。为此,我们设计了一种名为NanoMVG的低功耗多任务模型,用于航道具身感知,引导相机和4D毫米波雷达通过自然语言定位特定对象。NanoMVG可同时执行框级和掩码级视觉定位任务。与其他视觉定位模型相比,NanoMVG在WaterVG数据集上取得了极具竞争力的性能,尤其在恶劣环境中表现突出,并具有超低功耗以实现长续航。

关键词

引用

@article{arxiv.2408.17207,
  title  = {NanoMVG: USV-Centric Low-Power Multi-Task Visual Grounding based on Prompt-Guided Camera and 4D mmWave Radar},
  author = {Runwei Guan and Jianan Liu and Liye Jia and Haocheng Zhao and Shanliang Yao and Xiaohui Zhu and Ka Lok Man and Eng Gee Lim and Jeremy Smith and Yutao Yue},
  journal= {arXiv preprint arXiv:2408.17207},
  year   = {2025}
}

备注

8 pages, 6 figures