藏语声调发生连续统的计算研究
计算与语言
2025-10-28 v1
摘要
声调发生——音段对立演变为词汇声调的历史过程——传统上通过比较重建和声学语音学进行研究。我们引入一种计算方法,通过测量音高操控如何影响自动语音识别性能,来量化音高在这一音变不同阶段的功能作用。通过对一组密切相关的藏语语言进行音高平坦化敏感度分析,我们发现了声调发生连续统的证据:无声调的安多方言对音高移除的容忍度最高,而完全声调化的卫藏方言则表现出严重退化,中间的康巴方言则介于这两个极端之间。这些梯度效应表明,当语言从基于辅音的词汇对立过渡到基于声调的对立时,自动语音识别模型隐式地学习了音高功能负荷的转移。我们的发现表明,计算方法可以捕捉音变的精细阶段,并提示仅基于最小对立的传统功能负荷度量可能高估了过渡系统中的音高依赖性,在这些系统中,音段和超音段线索在语音上仍然相互交织。
引用
@article{arxiv.2510.22485,
title = {The Tonogenesis Continuum in Tibetan: A Computational Investigation},
author = {Siyu Liang and Zhaxi Zerong},
journal= {arXiv preprint arXiv:2510.22485},
year = {2025}
}