中文

单次驱动的人脸动画平台

计算机视觉与模式识别 2024-07-15 v1

摘要

人脸动画的目标是利用视频或音频输入提供的驱动条件,从单张参考人脸生成动态且富有表现力的说话头视频。当前方法通常需要针对特定身份进行微调,并且由于Wav2Pose模块效果有限,常常无法生成富有表现力的视频。为了促进单次和更连续的说话头视频的生成,我们通过集成人脸定位器和运动帧机制,改进了一个现有的图像到视频模型。随后,我们使用大量人脸视频数据集优化该模型,显著增强了其生成高质量、富有表现力的说话头视频的能力。此外,我们利用Gradio框架开发了一个演示平台,简化了流程,使用户能够快速创建定制的说话头视频。

关键词

引用

@article{arxiv.2407.08949,
  title  = {One-Shot Pose-Driving Face Animation Platform},
  author = {He Feng and Donglin Di and Yongjia Ma and Wei Chen and Tonghua Su},
  journal= {arXiv preprint arXiv:2407.08949},
  year   = {2024}
}