HeySQuAD:一个口语问答数据集
计算与语言
2024-02-28 v2 人工智能
摘要
口语问答(SQA)系统对数字助手及其他现实应用场景至关重要,但由于人类口语问题的重要性,评估其性能是一项挑战。本研究提出一个名为 HeySQuAD 的新型大规模社区共享 SQA 数据集,包含 76k 条人类口语问题、97k 条机器生成问题,以及来自 SQuAD 问答数据集的相应文本答案。我们的目标是衡量机器准确理解含噪声口语问题并提供可靠答案的能力。通过广泛测试,我们证明:与使用仅原始 SQuAD 文本问题训练相比,使用转写的人类口语问题和原始 SQuAD 问题训练可使回答人类口语问题的准确率显著提升(12.51%)。此外,使用更高质量的转写进行评估可带来进一步的 2.03% 提升。本研究对 SQA 系统的开发及其满足现实场景用户需求的能力具有重要意义。
引用
@article{arxiv.2304.13689,
title = {HeySQuAD: A Spoken Question Answering Dataset},
author = {Yijing Wu and SaiKrishna Rallabandi and Ravisutha Srinivasamurthy and Parag Pravin Dakle and Alolika Gon and Preethi Raghavan},
journal= {arXiv preprint arXiv:2304.13689},
year = {2024}
}