中文

澳大利亚原住民语言与高资源语言间语音相似性的表征:以Dharawal为例的案例研究

音频与语音处理 2025-09-03 v1

摘要

澳大利亚原住民语言具有重要的文化与语言学价值,但在现代语音AI系统中仍严重缺乏代表性。尽管最先进的语音基础模型和自动语音识别在高资源环境下表现出色,但它们往往难以泛化至低资源语言,尤其是那些缺乏干净、标注语音数据的语言。在本工作中,我们通过仔细搜集和处理公开可用的录音,收集并清洗了一个低资源澳大利亚原住民语言Dharawal的语音数据集。使用该数据集,我们利用预训练的多语言语音编码器分析了Dharawal与107种高资源语言之间的语音相似性。我们的方法结合了:(1) 误分类率分析以评估语言混淆度,以及 (2) 在嵌入空间中使用余弦相似度和Fréchet Inception Distance (FID) 的细粒度相似性度量。实验结果表明,Dharawal与拉丁语、毛利语、韩语、泰语和威尔士语等语言具有高度的语音相似性。这些发现为未来的迁移学习和模型适配工作提供了实用指导,并强调了数据收集和基于嵌入的分析在支持濒危语言社区语音技术方面的重要性。

关键词

引用

@article{arxiv.2509.01419,
  title  = {Characterization of Speech Similarity Between Australian Aboriginal and High-Resource Languages: A Case Study on Dharawal},
  author = {Ting Dang and Trini Manoj Jeyaseelan and Eliathamby Ambikairajah and Vidhyasaharan Sethu},
  journal= {arXiv preprint arXiv:2509.01419},
  year   = {2025}
}

备注

Accepted at APSIPA ASC 2025