具有动态 Lambda 的姿势引导手语视频 GAN
计算机视觉与模式识别
2021-05-07 v1
摘要
我们提出了一种利用 GAN 合成手语视频的新方法。我们扩展了 Stoll 等人的先前工作,使用 Soft-Gated Warping-GAN 的人体语义解析器来生成由区域级空间布局引导的逼真视频。合成目标姿势提升了在独立且对比鲜明的手语者上的性能。因此,我们使用具有超过 200 名手语者的高度异构 MS-ASL 数据集评估了我们的系统,获得了 0.893 的 SSIM。此外,我们向生成器引入了一种周期性加权方法,其重新激活训练并带来定量上更优的结果。
引用
@article{arxiv.2105.02742,
title = {Pose-Guided Sign Language Video GAN with Dynamic Lambda},
author = {Christopher Kissel and Christopher Kümmel and Dennis Ritter and Kristian Hildebrand},
journal= {arXiv preprint arXiv:2105.02742},
year = {2021}
}