INTERSPEECH 2009 情感挑战重访:评估 15 年语音情感识别进展
计算与语言
2025-04-11 v1
摘要
我们重访 INTERSPEECH 2009 情感挑战——首个语音情感识别(SER)挑战赛,评估此后十五年内代表性深度学习模型的进展。我们首先使用固定的超参数训练每个模型,并进一步对表现最佳的模型进行网格搜索微调。结果始终在官方测试集上报告,仅使用的验证集用于早停。大多数模型得分低于或接近官方基线,仅在超参数调优后略胜于原始挑战获奖者。我们的工作表明,尽管近期进展有限,FAU-AIBO 仍是一个极具挑战性的基准。有趣的副作用是,较新方法并不一定优于旧方法,表明向“解决”SER 的进展并非必然单调。
引用
@article{arxiv.2406.06401,
title = {INTERSPEECH 2009 Emotion Challenge Revisited: Benchmarking 15 Years of Progress in Speech Emotion Recognition},
author = {Andreas Triantafyllopoulos and Anton Batliner and Simon Rampp and Manuel Milling and Björn Schuller},
journal= {arXiv preprint arXiv:2406.06401},
year = {2025}
}
备注
Accepted to INTERSPEECH 2024