欢乐还是恶意的笑?自然音频样本数据库分析
声音
2023-05-24 v1 音频与语音处理
摘要
我们在 Google AudioSet 数据库的基础上进行了数据收集,选取了标注为笑声(laughter)的样本子集。选取标准是呈现一种交际行为,且明确带有正向(一同笑)或负向(被嘲笑)的内涵。基于该标注数据,我们进行了两项实验:一方面,我们手动提取并分析语音特征;另一方面,我们通过将若干自动提取的声学特征集与机器学习算法系统结合,开展了若干机器学习实验。结果表明,性能最佳的模型可达到 0.7 的未加权平均召回率。
引用
@article{arxiv.2305.14023,
title = {Happy or Evil Laughter? Analysing a Database of Natural Audio Samples},
author = {Aljoscha Düsterhöft and Felix Burkhardt and Björn W. Schuller},
journal= {arXiv preprint arXiv:2305.14023},
year = {2023}
}