SOTAVerified

Talking Face Generation

Talking face generation aims to synthesize a sequence of face images that correspond to given speech semantics

( Image credit: Talking Face Generation by Adversarially Disentangled Audio-Visual Representation )

Papers

Showing 81–90 of 110 papers

TitleStatusHype
GeneFace++: Generalized and Stable Real-Time Audio-Driven 3D Talking Face Generation—0
GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection—0
GSTalker: Real-time Audio-Driven Talking Face Generation via Deformable Gaussian Splatting—0
Hierarchical Cross-Modal Talking Face Generation With Dynamic Pixel-Wise Loss—0
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model—0
High-fidelity Generalized Emotional Talking Face Generation with Multi-modal Emotion Space Learning—0
Arbitrary Talking Face Generation via Attentional Audio-Visual Coherence Learning—0
Identity-Preserving Realistic Talking Face Generation—0
Talking Face Generation with Multilingual TTS—0
That's What I Said: Fully-Controllable Talking Face Generation—0
Show:102550
← PrevPage 9 of 11Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1EmoGenEmoAcc83.2—Unverified
#ModelMetricClaimedVerifiedStatus
1LipGANLMD0.6—Unverified