中文

用于视频人脸解析的带特征对齐的 Shuffle Transformer

计算机视觉与模式识别 2021-06-17 v1

摘要

本技术简报介绍 Team TCParser 在 CVPR 2021 第三届情境中的人(PIC)研讨会与挑战赛短视频人脸解析赛道中的方案。本文中,我们引入一种基于跨窗口的 Shuffle Transformer 强骨干网络以呈现准确的人脸解析表征。为进一步获得更精细的分割结果,尤其在边缘处,我们引入特征对齐聚合(FAA)模块。它能有效缓解由多分辨率特征聚合引起的特征错位问题。得益于更强的骨干与更好的特征聚合,所提方法在第三届情境中的人(PIC)研讨会与挑战赛短视频人脸解析赛道取得 86.9519% 分数,排名首位。

关键词

引用

@article{arxiv.2106.08650,
  title  = {Shuffle Transformer with Feature Alignment for Video Face Parsing},
  author = {Rui Zhang and Yang Han and Zilong Huang and Pei Cheng and Guozhong Luo and Gang Yu and Bin Fu},
  journal= {arXiv preprint arXiv:2106.08650},
  year   = {2021}
}

备注

technical report