中文

INTERSPEECH 2009 情感挑战重访:评估 15 年语音情感识别进展

计算与语言 2025-04-11 v1

摘要

我们重访 INTERSPEECH 2009 情感挑战——首个语音情感识别(SER)挑战赛,评估此后十五年内代表性深度学习模型的进展。我们首先使用固定的超参数训练每个模型,并进一步对表现最佳的模型进行网格搜索微调。结果始终在官方测试集上报告,仅使用的验证集用于早停。大多数模型得分低于或接近官方基线,仅在超参数调优后略胜于原始挑战获奖者。我们的工作表明,尽管近期进展有限,FAU-AIBO 仍是一个极具挑战性的基准。有趣的副作用是,较新方法并不一定优于旧方法,表明向“解决”SER 的进展并非必然单调。

关键词

引用

@article{arxiv.2406.06401,
  title  = {INTERSPEECH 2009 Emotion Challenge Revisited: Benchmarking 15 Years of Progress in Speech Emotion Recognition},
  author = {Andreas Triantafyllopoulos and Anton Batliner and Simon Rampp and Manuel Milling and Björn Schuller},
  journal= {arXiv preprint arXiv:2406.06401},
  year   = {2025}
}

备注

Accepted to INTERSPEECH 2024