论句级信令语言翻译的局限性
软件工程
2024-06-18 v1 社会与信息网络
计量经济学
摘要
历史上,信令语言机器翻译被建模为句子级任务:由连续叙事构成的数据集被分割成离散片段,输入模型进行处理。本文探讨了这种任务建模方式的局限性。首先,我们调查了依赖话语级上下文的多种语言现象。随后作为案例研究,我们进行首次人类基准测试,实际将人类嵌入机器学习任务框架中,而非仅为其提供整个文档的上下文。该人类基准测试——针对ASL至英语翻译的How2Sign数据集——显示,在我们抽样的33%句子中,流利的盲文翻译员仅凭额外的话语级上下文,仅能理解片段的关键部分。这些结果凸显了在将机器学习引入新领域时,必须理解和核查实例的重要性。
引用
@article{arxiv.2406.11046,
title = {Impact of the Availability of ChatGPT on Software Development: A Synthetic Difference in Differences Estimation using GitHub Data},
author = {Alexander Quispe and Rodrigo Grijalba},
journal= {arXiv preprint arXiv:2406.11046},
year = {2024}
}
备注
20 pages