中文

AutoBio: 用于数字生物实验室中机器人自动化的仿真与基准

机器人学 2025-05-30 v3

摘要

视觉-语言-动作 (VLA) 模型通过联合利用视觉、语言和本体感知模态生成动作轨迹,已显示出作为通用机器人策略的潜力。尽管近期基准已推动 VLA 研究在家庭任务方面的发展,但专业科学领域仍鲜有探索。我们提出了 AutoBio,一个旨在评估生物实验室环境中机器人自动化的仿真框架和基准——该应用领域结合了结构化协议与严苛精度要求以及多模态交互。AutoBio 通过为实际实验室仪器建立数据采集管道、为实验室工作流程中常见机制开发专用物理插件,并构建支持动态仪器界面和透明材料的基于物理的渲染堆栈来扩展现有仿真能力。我们的基准涵盖三个难度级别的生物学任务,实现对语言引导机器人操作在实验室实施方案中的标准化评估。我们提供了演示生成设施以及与 VLA 模型的无缝集成。两个 SOTA VLA 模型的基准评估揭示了在科学工作流程中进行精确操作、视觉推理和指令遵循方面的显著差距。通过发布 AutoBio,我们旨在催化发展用于复杂、高精度和多模态专业环境的通用机器人系统。该模拟器和基准已公开,以促进可重复研究。

关键词

引用

@article{arxiv.2505.14030,
  title  = {AutoBio: A Simulation and Benchmark for Robotic Automation in Digital Biology Laboratory},
  author = {Zhiqian Lan and Yuxuan Jiang and Ruiqi Wang and Xuanbing Xie and Rongkui Zhang and Yicheng Zhu and Peihang Li and Tianshuo Yang and Tianxing Chen and Haoyu Gao and Xiaokang Yang and Xuelong Li and Hongyuan Zhang and Yao Mu and Ping Luo},
  journal= {arXiv preprint arXiv:2505.14030},
  year   = {2025}
}