中文

基于大规模人脸识别数据集预训练的卷积神经网络用于视频情感分类

计算机视觉与模式识别 2017-11-15 v1

摘要

本文描述了我们参加 EmotiW 2017 情感识别挑战赛的方案。我们提出一种集成多个模型的方案,从视频中捕获空间与音频特征。空间特征由在大规模人脸识别数据集上预训练的卷积神经网络捕获。我们表明,使用强工业级人脸识别网络可提升情感识别的准确率。利用我们的集成模型,在测试集上较此前最佳结果提升约 1%,在不使用任何视觉时序信息的情况下达到 60.03% 的分类准确率。

关键词

引用

@article{arxiv.1711.04598,
  title  = {Convolutional neural networks pretrained on large face recognition datasets for emotion classification from video},
  author = {Boris Knyazev and Roman Shvetsov and Natalia Efremova and Artem Kuharenko},
  journal= {arXiv preprint arXiv:1711.04598},
  year   = {2017}
}

备注

4 pages