免训练的任务导向抓取生成
机器人学
2025-10-07 v4
摘要
本文提出了一种免训练的任务导向抓取生成流程,该流程结合了预训练的抓取生成模型与视觉-语言模型(VLM)。与仅关注稳定抓取的传统方法不同,我们的方法通过利用 VLM 的语义推理能力来融入任务特定需求。我们评估了五种查询策略,每种策略利用候选抓取的不同视觉表示,并在抓取成功率和任务合规率方面均显著优于基线方法,总体成功率绝对提升高达 36.9%。我们的结果突显了 VLM 在增强任务导向操作方面的潜力,为机器人抓取和人机交互的未来研究提供了见解。
引用
@article{arxiv.2502.04873,
title = {Training-free Task-oriented Grasp Generation},
author = {Jiaming Wang and Diwen Liu and Jizhuo Chen and Harold Soh},
journal= {arXiv preprint arXiv:2502.04873},
year = {2025}
}
备注
Jiaming Wang, Diwen Liu, and Jizhuo Chen contributed equally