中文

语言对象数据的空间建模方法:分析大不列颠各地的方言声音变异

统计方法学 2018-07-02 v4 应用统计

摘要

方言变异是语言学和其他社会科学中相当受关注的课题。然而,传统上它是使用代理(转录文本)而非直接的声学录音进行研究的。我们引入了新的统计技术来分析地理定位的语音录音,并探索发音在感兴趣区域内的连续空间变异,这与提供区域离散划分的传统等语线不同。此类数据需要显式地对均值和协方差的变异进行建模。通常的欧几里得度量并不适用,因此我们引入了 dd-协方差的概念,它允许在空间和个体位置上进行一致估计。随后,我们提出了针对这些对象的空间平滑方法,该方法考虑了感兴趣区域可能存在的非凸几何形状。我们将所提出的方法应用于存储于伦敦大英图书馆的英国国家语料库(British National Corpus)口语部分数据,并生成了大不列颠上方的方言变异地图。此外,这些方法允许在感兴趣区域内进行声学重建,使研究人员能够“聆听”统计分析结果。

关键词

引用

@article{arxiv.1610.10040,
  title  = {A Spatial Modeling Approach for Linguistic Object Data: Analysing dialect sound variations across Great Britain},
  author = {Shahin Tavakoli and Davide Pigoli and John A. D. Aston and John S. Coleman},
  journal= {arXiv preprint arXiv:1610.10040},
  year   = {2018}
}

备注

18 figures