Burst2Vec:一种从声音爆发中预测情绪、年龄与来源的对立多任务方法
声音
2022-10-19 v2 计算与语言
音频与语音处理
摘要
我们提出 Burst2Vec,我们的多任务学习方法,用于从声音爆发中预测情绪、年龄和来源(即母语国家/语言)。Burst2Vec 利用预训练语音表示从原始波形中捕获声学信息,并通过对抗训练引入模型去偏置的概念。我们的模型相比使用预提取特征的基线实现了 30% 的相对性能提升,并在 ICML ExVo 2022 多任务挑战赛中所有参与者中得分最高。
引用
@article{arxiv.2206.12469,
title = {Burst2Vec: An Adversarial Multi-Task Approach for Predicting Emotion, Age, and Origin from Vocal Bursts},
author = {Atijit Anuchitanukul and Lucia Specia},
journal= {arXiv preprint arXiv:2206.12469},
year = {2022}
}