中文

语音分段任务中专家注视与行为的多模态语料库

人机交互 2018-05-14 v3 计算与语言

摘要

语音分段是将语音拆分为不同语音单元的过程。人类专家通常使用分析软件通过听觉和视觉线索手动执行该任务,这是一个极其耗时的过程。已有自动分段的方法,但其准确性并不总是足够。为了改进自动分段,我们需要使其尽可能接近手动分段进行建模。该语料库旨在通过记录执行分段任务的专家来捕捉人类分段行为。我们相信,这些数据将使我们能够突出手动分段的重要方面,从而可用于自动分段以提高其准确性。

关键词

引用

@article{arxiv.1712.04798,
  title  = {A Multimodal Corpus of Expert Gaze and Behavior during Phonetic Segmentation Tasks},
  author = {Arif Khan and Ingmar Steiner and Yusuke Sugano and Andreas Bulling and Ross Macdonald},
  journal= {arXiv preprint arXiv:1712.04798},
  year   = {2018}
}