中文

CompliantVLA-adaptor:用于安全接触丰富操作的 VLM 引导变阻抗动作

机器人学 2026-03-18 v2

摘要

我们提出了一种 CompliantVLA-adaptor,它通过视觉语言模型(VLM)感知上下文的变阻抗控制(VIC)来增强最先进的视觉-语言-动作(VLA)模型,以提高接触丰富的机器人操作任务的安全性和有效性。现有的 VLA 系统(例如 RDT、Pi0.5、OpenVLA-oft)通常输出位置,但缺乏力感知适应能力,导致在涉及接触、柔顺性或不确定性的物理任务中出现不安全或失败的交互。在提出的 CompliantVLA-adaptor 中,VLM 从图像和自然语言中解释任务上下文,以适应 VIC 控制器的刚度和阻尼参数。这些参数进一步使用实时力/力矩反馈进行调节,以确保交互力保持在安全阈值内。我们证明了我们的方法在一系列复杂的接触丰富任务上优于 VLA 基线,无论是在仿真还是现实世界中,都提高了成功率并减少了力违规。这项工作为安全的物理接触丰富操作基础模型提供了一条有前景的路径。我们在 https://sites.google.com/view/compliantvla 发布了我们的代码、提示词以及力-力矩-阻抗-场景上下文数据集。

关键词

引用

@article{arxiv.2601.15541,
  title  = {CompliantVLA-adaptor: VLM-Guided Variable Impedance Action for Safe Contact-Rich Manipulation},
  author = {Heng Zhang and Wei-Hsing Huang and Qiyi Tong and Gokhan Solak and Puze Liu and Kaidi Zhang and Sheng Liu and Jan Peters and Yu She and Arash Ajoudani},
  journal= {arXiv preprint arXiv:2601.15541},
  year   = {2026}
}

备注

under review