中文

通过身体、上下文与视觉-语义嵌入损失的视频情感理解

计算机视觉与模式识别 2020-11-02 v1

摘要

我们展示了在首届身体表达情感理解(BEEU)国际研讨会挑战赛中的获胜提交。基于近期关于上下文/环境对情感的影响以及使用词嵌入具有语义意义的视觉表示的文献,我们扩展了时序分段网络(Temporal Segment Network)框架以容纳这些要素。我们的方法在身体语言数据集(BoLD)的验证集上得到验证,并在测试集上取得了 0.26235 的情感识别分数,超越了此前 0.2530 的最佳结果。

关键词

引用

@article{arxiv.2010.16396,
  title  = {Emotion Understanding in Videos Through Body, Context, and Visual-Semantic Embedding Loss},
  author = {Panagiotis Paraskevas Filntisis and Niki Efthymiou and Gerasimos Potamianos and Petros Maragos},
  journal= {arXiv preprint arXiv:2010.16396},
  year   = {2020}
}

备注

Winner of the First International Workshop on Bodily Expressed Emotion Understanding Challenge (ECCVW-2020)