中文

普通话中单词特有的声调实现

计算与语言 2026-05-20 v2

摘要

普通话二字词的音高轮廓通常被理解为由构成该单字词的声调所决定,同时受到语速、相邻声调的共谐、音段构成以及可预测性等因素所施加的约束。本研究表明,声调实现也部分取决于单词的语义。我们首先基于台湾普通话自然对话语料库,运用广义可加回归模型(聚焦上升-下降声调模式),在控制说话人和语境效应后发现,单词类型是比所有已建立的单词形态相关预测因子(包括这些因子)更强的声调实现预测因子。重要的是,加入语义信息后,预测准确率进一步提升。随后我们使用基于语境特定词嵌入的计算模型,发现特定音高轮廓可在保留样本上达到50%的准确率预测单词类型,而语境敏感的特定词嵌入可将音高轮廓的预测准确率达到40%。这些准确率远高于随机水平一个数量级,表明单词音高轮廓与其语义之间的关系足够强大,可能对语言使用者具有功能性。讨论了这些经验发现的理论意义。

关键词

引用

@article{arxiv.2405.07006,
  title  = {Word-specific tonal realizations in Mandarin},
  author = {Yu-Ying Chuang and Melanie J. Bell and Yu-Hsiang Tseng and R. Harald Baayen},
  journal= {arXiv preprint arXiv:2405.07006},
  year   = {2026}
}