LSA-T:首个用于手语翻译的连续阿根廷手语数据集
计算机视觉与模式识别
2022-11-29 v1 机器学习
摘要
手语翻译 (SLT) 是一个活跃的研究领域,涵盖人机交互、计算机视觉、自然语言处理和机器学习。该领域的进展有望带来听障人士更高程度的融入。据我们所知,本文提出了首个连续阿根廷手语 (LSA) 数据集。它包含从 CN Sordos YouTube 频道提取的 14,880 个 LSA 句子级视频,并带有每位手语者的标签和关键点标注。我们还提出了一种推断活跃手语者的方法,对数据集的特征进行了详细分析,提供了一个用于探索数据集的可视化工具,以及一个作为未来实验基线的神经 SLT 模型。
引用
@article{arxiv.2211.15481,
title = {LSA-T: The first continuous Argentinian Sign Language dataset for Sign Language Translation},
author = {Pedro Dal Bianco and Gastón Ríos and Franco Ronchetti and Facundo Quiroga and Oscar Stanchi and Waldo Hasperué and Alejandro Rosete},
journal= {arXiv preprint arXiv:2211.15481},
year = {2022}
}
备注
Accepted at IBERAMIA 2022. Dataset download info at https://github.com/midusi/LSA-T