iLSU-T:阿根廷手语翻译开放数据集
计算与语言
2025-07-30 v1 人工智能
摘要
自动手语翻译近年来在计算机视觉和计算语言学社区中受到广泛关注。鉴于每个手语国家的独特性,机器翻译需要本地数据来开发新技术并调整现有技术。本工作提出iLSU-T,一个包含经专业翻译的阿根廷手语RGB视频、音频及文本转录的开放数据集。这种类型的数据对于开发新方法以理解或生成手语处理工具至关重要。iLSU-T包含超过185小时的经济公开电视转播的手语视频,涵盖多样主题,并包含18名专业手语解释员的参与。本文 presented若干实验,使用三种最先进的翻译算法。旨在建立此数据集的基准并评估其有用性及所提出的数据处理管道。实验结果凸显了为手语翻译和理解需求更本地化数据集的重要性,这些数据集对于开发改善所有个体可访问性和包容性工具至关重要。我们的数据和代码可公开获取。
引用
@article{arxiv.2507.21104,
title = {iLSU-T: an Open Dataset for Uruguayan Sign Language Translation},
author = {Ariel E. Stassi and Yanina Boria and J. Matías Di Martino and Gregory Randall},
journal= {arXiv preprint arXiv:2507.21104},
year = {2025}
}
备注
10 pages, 5 figures, 19th International Conference on Automatic Face and Gesture Recognition IEEE FG 2025