一种多人体视频时空动作数据集标注方法
计算机视觉与模式识别
2022-04-27 v2
摘要
时空动作检测是视频理解中一个重要且具有挑战性的问题。然而,现有大规模时空动作数据集在特定领域的应用受限,且目前没有制作时空动作数据集的公开工具,研究人员定制时空动作数据集需要耗费大量时间和精力,因此我们提出了一种多人体视频时空动作数据集标注方法。首先,我们使用 ffmpeg 对视频进行裁剪并逐帧提取;然后使用 yolov5 检测视频帧中的人体,再使用 deep sort 检测视频帧中人体的 ID。通过对 yolov5 和 deep sort 的检测结果进行处理,我们可以得到时空动作数据集的标注文件,从而完成定制时空动作数据集的工作。https://github.com/Whiffe/Custom-ava-dataset_Custom-Spatio-Temporally-Action-Video-Dataset
引用
@article{arxiv.2204.10160,
title = {A Multi-Person Video Dataset Annotation Method of Spatio-Temporally Actions},
author = {Fan Yang},
journal= {arXiv preprint arXiv:2204.10160},
year = {2022}
}