中文

Burst2Vec:一种从声音爆发中预测情绪、年龄与来源的对立多任务方法

声音 2022-10-19 v2 计算与语言 音频与语音处理

摘要

我们提出 Burst2Vec,我们的多任务学习方法,用于从声音爆发中预测情绪、年龄和来源(即母语国家/语言)。Burst2Vec 利用预训练语音表示从原始波形中捕获声学信息,并通过对抗训练引入模型去偏置的概念。我们的模型相比使用预提取特征的基线实现了 30% 的相对性能提升,并在 ICML ExVo 2022 多任务挑战赛中所有参与者中得分最高。

关键词

引用

@article{arxiv.2206.12469,
  title  = {Burst2Vec: An Adversarial Multi-Task Approach for Predicting Emotion, Age, and Origin from Vocal Bursts},
  author = {Atijit Anuchitanukul and Lucia Specia},
  journal= {arXiv preprint arXiv:2206.12469},
  year   = {2022}
}