中文

LSA-T:首个用于手语翻译的连续阿根廷手语数据集

计算机视觉与模式识别 2022-11-29 v1 机器学习

摘要

手语翻译 (SLT) 是一个活跃的研究领域,涵盖人机交互、计算机视觉、自然语言处理和机器学习。该领域的进展有望带来听障人士更高程度的融入。据我们所知,本文提出了首个连续阿根廷手语 (LSA) 数据集。它包含从 CN Sordos YouTube 频道提取的 14,880 个 LSA 句子级视频,并带有每位手语者的标签和关键点标注。我们还提出了一种推断活跃手语者的方法,对数据集的特征进行了详细分析,提供了一个用于探索数据集的可视化工具,以及一个作为未来实验基线的神经 SLT 模型。

关键词

引用

@article{arxiv.2211.15481,
  title  = {LSA-T: The first continuous Argentinian Sign Language dataset for Sign Language Translation},
  author = {Pedro Dal Bianco and Gastón Ríos and Franco Ronchetti and Facundo Quiroga and Oscar Stanchi and Waldo Hasperué and Alejandro Rosete},
  journal= {arXiv preprint arXiv:2211.15481},
  year   = {2022}
}

备注

Accepted at IBERAMIA 2022. Dataset download info at https://github.com/midusi/LSA-T