中文

nEMO:波兰语情感语音数据集

计算与语言 2024-04-10 v1 声音 音频与语音处理

摘要

语音情感识别近年来因其在医疗保健、客户服务和对话系统个性化中的潜在应用而变得越来越重要。然而,该领域的一个主要问题是缺乏充分代表不同语系基本情感状态的数据集。由于涵盖斯拉夫语言的数据集很少,因此有必要解决这一研究空白。本文介绍了nEMO的开发,这是一个新颖的波兰语情感语音语料库。该数据集包含超过3小时的样本,由九位演员录制,演绎了六种情感状态:愤怒、恐惧、快乐、悲伤、惊讶和中性状态。所使用的文本材料经过精心挑选,以充分代表波兰语的语音特点。该语料库在知识共享许可(CC BY-NC-SA 4.0)下免费提供。

关键词

引用

@article{arxiv.2404.06292,
  title  = {nEMO: Dataset of Emotional Speech in Polish},
  author = {Iwona Christop},
  journal= {arXiv preprint arXiv:2404.06292},
  year   = {2024}
}

备注

Accepted for LREC-Coling 2024