中文

使用条件生成对抗网络的语音驱动面部重演

计算机视觉与模式识别 2018-03-21 v1

摘要

我们提出了一种在给定音频输入的情况下,生成具有准确唇形同步的逼真人脸图像的新方法。通过使用循环神经网络,我们基于音频特征获得了嘴部关键点。我们利用条件生成对抗网络的能力,生成以一组关键点为条件的高度逼真的人脸。这两个网络结合在一起,能够生成与输入音轨同步的自然人脸序列。

关键词

引用

@article{arxiv.1803.07461,
  title  = {Speech-Driven Facial Reenactment Using Conditional Generative Adversarial Networks},
  author = {Seyed Ali Jalalifar and Hosein Hasani and Hamid Aghajan},
  journal= {arXiv preprint arXiv:1803.07461},
  year   = {2018}
}

备注

Submitted for ECCV 2018