中文

FViT-Grasp:利用快速视觉Transformer抓取物体

机器人学 2023-11-27 v1 计算机视觉与模式识别

摘要

本研究解决了操纵这一机器人领域的突出挑战。我们设计了一种新颖的方法,用于快速且精确地识别机器人操纵物体时的最优抓取点。我们的方法利用快速视觉 Transformer(FViT),这是一种为处理视觉数据并预测最合适抓取位置而设计的神经网络。我们的方法在速度上展现出最先进的性能,同时保持了高水平的精度,有望部署于实时机器人抓取应用。我们认为本研究为未来基于视觉的机器人抓取应用研究提供了基线。其高速度和高精度使研究者更接近于真实生活中的应用。

关键词

引用

@article{arxiv.2311.13986,
  title  = {FViT-Grasp: Grasping Objects With Using Fast Vision Transformers},
  author = {Arda Sarp Yenicesu and Berk Cicek and Ozgur S. Oguz},
  journal= {arXiv preprint arXiv:2311.13986},
  year   = {2023}
}