语义差分在语音情感识别中的应用:从描述性与表达性语音角色获取的洞见
计算与语言
2025-10-06 v1 人工智能
摘要
语音情感识别(SER)对于改进人机交互至关重要,但其准确率仍受制于情感语音中复杂细微差别的制约。在本研究中,我们区分了描述性语义,这代表了语音的上下文内容,以及表达性语义,这反映了说话者的情感状态。在观看情感充沛的电影片段后,我们记录了受试者描述经历的音频剪辑,以及每个剪辑的预期情感标签、受试者的自评情感反应以及他们的价值/唤醒评分。通过实验,我们展示了描述性语义与预期情感一致,而表达性语义与唤醒情感相关。我们的发现为人机交互中的SER应用指明了方向,为构建更具情境感知的AI系统铺平了道路。
引用
@article{arxiv.2510.03060,
title = {Semantic Differentiation in Speech Emotion Recognition: Insights from Descriptive and Expressive Speech Roles},
author = {Rongchen Guo and Vincent Francoeur and Isar Nejadgholi and Sylvain Gagnon and Miodrag Bolic},
journal= {arXiv preprint arXiv:2510.03060},
year = {2025}
}
备注
Accepted to the *SEM conference collocated with EMNLP2025