无语言先验条件下从声学语音和无声输入进行早期语言学习的计算建模
计算与语言
2026-03-12 v2 人工智能
音频与语音处理
摘要
学习理解语音对通常发育的婴儿而言几乎毫无难度,但从信息处理的角度看,从声学语音中获取语言是巨大的挑战。本章综述了最近在计算模型中用于理解早期语言习得从语音和无声输入方面的进展。重点关注自监督和视觉 grounding 的感知学习模型。我们展示了这些模型如何在没有强语言先验条件的情况下,学习到语音的各个方面,而许多早期语言发展特征可通过一套共享的学习原则来解释——这些原则与多种语言习得理论和人类认知相容。我们还讨论了现代学习仿真在输入数据和与婴儿语言发展实证发现之间建立联系方面日益逼近。
引用
@article{arxiv.2603.08359,
title = {Computational modeling of early language learning from acoustic speech and audiovisual input without linguistic priors},
author = {Okko Räsänen},
journal= {arXiv preprint arXiv:2603.08359},
year = {2026}
}