使用条件生成对抗网络的语音驱动面部重演
计算机视觉与模式识别
2018-03-21 v1
摘要
我们提出了一种在给定音频输入的情况下,生成具有准确唇形同步的逼真人脸图像的新方法。通过使用循环神经网络,我们基于音频特征获得了嘴部关键点。我们利用条件生成对抗网络的能力,生成以一组关键点为条件的高度逼真的人脸。这两个网络结合在一起,能够生成与输入音轨同步的自然人脸序列。
引用
@article{arxiv.1803.07461,
title = {Speech-Driven Facial Reenactment Using Conditional Generative Adversarial Networks},
author = {Seyed Ali Jalalifar and Hosein Hasani and Hamid Aghajan},
journal= {arXiv preprint arXiv:1803.07461},
year = {2018}
}
备注
Submitted for ECCV 2018