SS-VAERR:基于视频的自监督表观情绪反应识别
计算机视觉与模式识别
2022-10-21 v1 机器学习
摘要
本工作关注于仅以视频为输入的表观情绪反应识别(AERR),并以自监督方式开展。网络首先在不同的自监督 pretext 任务上预训练,随后在下游目标任务上微调。自监督学习便于使用预训练架构和可能被认为不适合目标任务但有助于学习信息丰富表示从而为在更小更合适数据上进一步微调提供良好初始化的大型数据集。我们提出的贡献有两点:(1)针对仅视频的表观情绪反应识别架构,分析了不同最先进(SOTA)的 pretext 任务;(2)分析了可能进一步提升性能的回归与分类损失的各种组合。这两点贡献共同带来了当前仅视频、具连续标注的自发表观情绪反应识别的最优性能。
引用
@article{arxiv.2210.11341,
title = {SS-VAERR: Self-Supervised Apparent Emotional Reaction Recognition from Video},
author = {Marija Jegorova and Stavros Petridis and Maja Pantic},
journal= {arXiv preprint arXiv:2210.11341},
year = {2022}
}