中文

希腊戏剧剧本中的语音情感识别数据集

声音 2022-03-30 v1 计算与语言 机器学习

摘要

机器学习方法可被应用于文化领域,并提出向公众分发甚至呈现文化内容的新方式。例如,可采用语音分析自动生成戏剧剧本的字幕,以便(除其他目的外)帮助听力受损人群。除了使用自动语音识别(ASR)进行典型的语音转文本转录外,语音情感识别(SER)可用于自动预测戏剧剧本中语音对话的潜在情感内容,从而更深入地理解演员如何念出他们的台词。然而,文献中尚无来自戏剧剧本的真实世界数据集。本工作中我们提出 GreThE,即希腊戏剧情感数据集,一个公开可用的希腊戏剧剧本语音情感识别数据集合。该数据集包含来自不同演员和剧本的语句,以及相应的效价和唤醒度标注。为此,我们邀请多名标注者为每段语音录音提供输入,并在最终真值生成中考虑标注者间一致性。此外,我们讨论了使用本数据集以及该领域一些广泛使用的数据库,通过机器和深度学习框架进行的一些代表性实验的结果。

关键词

引用

@article{arxiv.2203.15568,
  title  = {A Dataset for Speech Emotion Recognition in Greek Theatrical Plays},
  author = {Maria Moutti and Sofia Eleftheriou and Panagiotis Koromilas and Theodoros Giannakopoulos},
  journal= {arXiv preprint arXiv:2203.15568},
  year   = {2022}
}