Computer Vision and Pattern Recognition · Computer Science
VASA-1: Lifelike Audio-Driven Talking Faces Generated in Real Time
Sicheng Xu, Guojun Chen, Yu-Xiao Guo, Jiaolong Yang +5
2024-11-01
Computer Vision and Pattern Recognition · Computer Science
VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior
Xusen Sun, Longhao Zhang, Hao Zhu, Peng Zhang +6
2023-12-08
Computer Vision and Pattern Recognition · Computer Science
OpFlowTalker: Realistic and Natural Talking Face Generation via Optical Flow Guidance
Shuheng Ge, Haoyu Xing, Li Zhang, Xiangqian Wu
2024-05-29
Computer Vision and Pattern Recognition · Computer Science
THEval. Evaluation Framework for Talking Head Video Generation
Nabyl Quignon, Baptiste Chopin, Yaohui Wang, Antitza Dantcheva
2026-05-21
Computer Vision and Pattern Recognition · Computer Science
Audio-Visual Face Reenactment
Madhav Agarwal, Rudrabha Mukhopadhyay, Vinay Namboodiri, C V Jawahar
2022-10-07
Computer Vision and Pattern Recognition · Computer Science
StyleTalker: One-shot Style-based Audio-driven Talking Head Video Generation
Dongchan Min, Minyoung Song, Eunji Ko, Sung Ju Hwang
2024-03-18
Computer Vision and Pattern Recognition · Computer Science
SwapTalk: Audio-Driven Talking Face Generation with One-Shot Customization in Latent Space
Zeren Zhang, Haibo Qin, Jiayu Huang, Yixin Li +3
2024-05-10
Computer Vision and Pattern Recognition · Computer Science
Landmark-guided Diffusion Model for High-fidelity and Temporally Coherent Talking Head Generation
Jintao Tan, Xize Cheng, Lingyu Xiong, Lei Zhu +5
2024-08-06
Computer Vision and Pattern Recognition · Computer Science
OmniTalker: One-shot Real-time Text-Driven Talking Audio-Video Generation With Multimodal Style Mimicking
Zhongjian Wang, Peng Zhang, Jinwei Qi, Guangyuan Wang +4
2025-06-04
Computer Vision and Pattern Recognition · Computer Science
Talking-head Generation with Rhythmic Head Motion
Lele Chen, Guofeng Cui, Celong Liu, Zhong Li +3
2020-07-20
Computer Vision and Pattern Recognition · Computer Science
Talking Face Generation by Conditional Recurrent Adversarial Network
Yang Song, Jingwen Zhu, Dawei Li, Xiaolong Wang +1
2019-07-29
Computer Vision and Pattern Recognition · Computer Science
IMTalker: Efficient Audio-driven Talking Face Generation with Implicit Motion Transfer
Bo Chen, Tao Liu, Qi Chen, Xie Chen +1
2025-12-01
Computer Vision and Pattern Recognition · Computer Science
OmniAvatar: Efficient Audio-Driven Avatar Video Generation with Adaptive Body Animation
Qijun Gan, Ruizi Yang, Jianke Zhu, Shaofei Xue +1
2025-06-24
Computer Vision and Pattern Recognition · Computer Science
Audio-driven Talking Face Generation with Stabilized Synchronization Loss
Dogucan Yaman, Fevziye Irem Eyiokur, Leonard Bärmann, Hazim Kemal Ekenel +1
2024-07-19
Computer Vision and Pattern Recognition · Computer Science
FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis
Mengchao Wang, Qiang Wang, Fan Jiang, Yaqi Fan +4
2025-04-08
Computer Vision and Pattern Recognition · Computer Science
VideoReTalking: Audio-based Lip Synchronization for Talking Head Video Editing In the Wild
Kun Cheng, Xiaodong Cun, Yong Zhang, Menghan Xia +5
2022-11-29
Computer Vision and Pattern Recognition · Computer Science
MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset
Kim Sung-Bin, Lee Chae-Yeon, Gihun Son, Oh Hyun-Bin +3
2024-06-21
Audio and Speech Processing · Electrical Eng. & Systems
LipVoicer: Generating Speech from Silent Videos Guided by Lip Reading
Yochai Yemini, Aviv Shamsian, Lior Bracha, Sharon Gannot +1
2024-03-29
Computer Vision and Pattern Recognition · Computer Science
RealTalk: Real-time and Realistic Audio-driven Face Generation with 3D Facial Prior-guided Identity Alignment Network
Xiaozhong Ji, Chuming Lin, Zhonggan Ding, Ying Tai +5
2024-08-09
Multimedia · Computer Science
Asynchronous Pipeline Parallelism for Real-Time Multilingual Lip Synchronization in Video Communication Systems
Eren Caglar, Amirkia Rafiei Oskooei, Mehmet Kutanoglu, Mustafa Keles +1
2025-12-23
Computer Vision and Pattern Recognition · Computer Science
EmoTalkingGaussian: Continuous Emotion-conditioned Talking Head Synthesis
Junuk Cha, Seongro Yoon, Valeriya Strizhkova, Francois Bremond +1
2025-02-04