QUB-PHEO:面向协同装配意图推断的基于视觉的双模多视角数据集
计算机视觉与模式识别
2025-10-24 v1 人机交互
图像与视频处理
信号处理
摘要
QUB-PHEO 引入了一个基于视觉的双模数据集,旨在推动人机交互(HRI)在装配操作和意图推断方面的研究。该数据集捕获了两个参与者之间丰富的多模态交互,其中一个参与者充当“机器人替代品”,涵盖各种装配任务,进一步细分为 36 个独立子任务。数据集包含丰富的视觉标注,包括面部关键点、注视、手势、物体定位等,针对 70 名参与者进行标注,QUB-PHEO 提供两个版本:50 名参与者的完整视频数据和所有 70 名参与者的视觉线索。旨在改进机器学习模型在 HRI 中的表现,QUB-PHEO 使我们能够深入分析细微的交互线索和意图,为该领域的研究提供了贡献。该数据集将在 https://github.com/exponentialR/QUB-PHEO 上公开,需遵守最终用户许可协议(EULA)。
引用
@article{arxiv.2409.15560,
title = {QUB-PHEO: A Visual-Based Dyadic Multi-View Dataset for Intention Inference in Collaborative Assembly},
author = {Samuel Adebayo and Seán McLoone and Joost C. Dessing},
journal= {arXiv preprint arXiv:2409.15560},
year = {2025}
}