基于颜色的情感表示用于语音情感识别
音频与语音处理
2026-02-19 v1 人工智能
声音
摘要
语音情感识别(SER)传统上依赖于分类或维度标签。然而,这种方法在表示情感的多样性和可解释性方面存在局限。为了克服这一局限,我们关注颜色属性,如色调、饱和度和明度,将情感表示为连续且可解释的分数。我们通过众包方式用颜色属性标注了一个情感语音语料库并进行了分析。此外,我们使用机器学习和深度学习构建了SER中颜色属性的回归模型,并探索了颜色属性回归和情感分类的多任务学习。结果,我们展示了语音中颜色属性与情感之间的关系,并成功开发了用于SER的颜色属性回归模型。我们还表明,多任务学习提高了每个任务的性能。
引用
@article{arxiv.2602.16256,
title = {Color-based Emotion Representation for Speech Emotion Recognition},
author = {Ryotaro Nagase and Ryoichi Takashima and Yoichi Yamashita},
journal= {arXiv preprint arXiv:2602.16256},
year = {2026}
}
备注
Submitted to EUSIPCO2026