语音分段任务中专家注视与行为的多模态语料库
人机交互
2018-05-14 v3 计算与语言
摘要
语音分段是将语音拆分为不同语音单元的过程。人类专家通常使用分析软件通过听觉和视觉线索手动执行该任务,这是一个极其耗时的过程。已有自动分段的方法,但其准确性并不总是足够。为了改进自动分段,我们需要使其尽可能接近手动分段进行建模。该语料库旨在通过记录执行分段任务的专家来捕捉人类分段行为。我们相信,这些数据将使我们能够突出手动分段的重要方面,从而可用于自动分段以提高其准确性。
引用
@article{arxiv.1712.04798,
title = {A Multimodal Corpus of Expert Gaze and Behavior during Phonetic Segmentation Tasks},
author = {Arif Khan and Ingmar Steiner and Yusuke Sugano and Andreas Bulling and Ross Macdonald},
journal= {arXiv preprint arXiv:1712.04798},
year = {2018}
}