Ego-1K——面向镜像视觉的大规模多视图视频数据集
计算机视觉与模式识别
2026-03-17 v1
摘要
我们提出 Ego-1K,一个大规模收集的时序同步镜像视觉视频数据集,旨�推动神经 3D 视频合成和动态场景理解。该数据集包含近 1000 短篇镜像视觉视频,使用定制的 12 台同步摄像机装置,围绕佩戴用户的 4 台 VR 头盔进行捕获。场景内容聚焦于手部动作和手部-物体交互,涵盖不同场景。我们描述了装置设计、数据处理和标定。该数据集为评估镜像视觉场景重建方法提供了新的基准,这是智能眼镜(拥有多摄像头)日益普及的重要研究方向。我们的实验表明,该数据集因近距离动态物体和装置自身运动导致的视差和图像运动,为现有的 3D 和 4D 新视角合成方法带来独特挑战。该数据集支持未来在这一具备挑战性的领域进行研究。数据集可在 https://huggingface.co/datasets/facebook/ego-1k 访问。
引用
@article{arxiv.2603.13741,
title = {Ego-1K -- A Large-Scale Multiview Video Dataset for Egocentric Vision},
author = {Jae Yong Lee and Daniel Scharstein and Akash Bapat and Hao Hu and Andrew Fu and Haoru Zhao and Paul Sammut and Xiang Li and Stephen Jeapes and Anik Gupta and Lior David and Saketh Madhuvarasu and Jay Girish Joshi and Jason Wither},
journal= {arXiv preprint arXiv:2603.13741},
year = {2026}
}
备注
To appear in CVPR 2026