用于视频人脸解析的带特征对齐的 Shuffle Transformer
计算机视觉与模式识别
2021-06-17 v1
摘要
本技术简报介绍 Team TCParser 在 CVPR 2021 第三届情境中的人(PIC)研讨会与挑战赛短视频人脸解析赛道中的方案。本文中,我们引入一种基于跨窗口的 Shuffle Transformer 强骨干网络以呈现准确的人脸解析表征。为进一步获得更精细的分割结果,尤其在边缘处,我们引入特征对齐聚合(FAA)模块。它能有效缓解由多分辨率特征聚合引起的特征错位问题。得益于更强的骨干与更好的特征聚合,所提方法在第三届情境中的人(PIC)研讨会与挑战赛短视频人脸解析赛道取得 86.9519% 分数,排名首位。
引用
@article{arxiv.2106.08650,
title = {Shuffle Transformer with Feature Alignment for Video Face Parsing},
author = {Rui Zhang and Yang Han and Zilong Huang and Pei Cheng and Guozhong Luo and Gang Yu and Bin Fu},
journal= {arXiv preprint arXiv:2106.08650},
year = {2021}
}
备注
technical report