VacuumVLA:用于复杂机器人操作的统一吸附与抓取工具
机器人学
2025-11-27 v1 人工智能
摘要
视觉语言动作模型通过利用大规模预训练的视觉和语言表示,显著推进了通用机器人操作的进展。在现有方法中,大多数VLA系统使用平行双指抓取器作为默认的末端执行器。然而,这些抓取器在处理某些实际任务时存在固有局限性,例如擦拭无把手的玻璃表面或打开抽屉。为克服这些挑战,本文提出一种低成本、集成的硬件设计,将机械双指抓取器与真空吸附单元相结合,实现单一末端执行器内的双模操作。该系统支持灵活切换或协同使用两种模式,扩展了可实现任务的范围。我们在两种最先进的VLA框架(DexVLA和Pi0)中验证了该设计的效率和实用性。实验结果表明,凭借所提出的混合末端执行器,机器人能够成功执行conventional双指抓取器无法完成的多项复杂任务。所有硬件设计和控制系统将对外公开发布。
引用
@article{arxiv.2511.21557,
title = {VacuumVLA: Boosting VLA Capabilities via a Unified Suction and Gripping Tool for Complex Robotic Manipulation},
author = {Hui Zhou and Siyuan Huang and Minxing Li and Hao Zhang and Lue Fan and Shaoshuai Shi},
journal= {arXiv preprint arXiv:2511.21557},
year = {2025}
}
备注
8 pages