SOTAVerified

Video Synchronization

Papers

Showing 1–30 of 30 papers

TitleStatusHype
FoleyCrafter: Bring Silent Videos to Life with Lifelike and Synchronized SoundsCode4
DRIFT open dataset: A drone-derived intelligence for traffic analysis in urban environmenCode1
Representation Learning via Global Temporal Alignment and Cycle-ConsistencyCode1
Technical Report of the Video Event Reconstruction and Analysis (VERA) System -- Shooter Localization, Models, Interface, and BeyondCode0
A subjective study of the perceptual acceptability of audio-video desynchronization in sports videosCode0
Beyond Audio and Pose: A General-Purpose Framework for Video SynchronizationCode0
Deep learning-based stereo camera multi-video synchronizationCode0
PoseSync: Robust pose based video synchronizationCode0
Rolling Shutter Camera Synchronization with Sub-millisecond AccuracyCode0
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control—0
Context-aware Talking Face Video Generation—0
Dance Any Beat: Blending Beats with Visuals in Dance Video Generation—0
SIDGAN: High-Resolution Dubbed Video Generation via Shift-Invariant Learning—0
Detection of Audio-Video Synchronization Errors Via Event Detection—0
AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation—0
ACCURATE METHOD OF TEMPORAL-SHIFT ESTIMATION FOR 3D VIDEO—0
Learning Robust Video Synchronization without Annotations—0
ModEFormer: Modality-Preserving Embedding for Audio-Video Synchronization using Transformers—0
Multi-Task Learning for Audio Visual Active Speaker Detection—0
OmniTalker: Real-Time Text-Driven Talking Head Generation with In-Context Audio-Visual Style Replication—0
Perfect match: Improved cross-modal embeddings for audio-visual synchronisation—0
Sub-millisecond Video Synchronization of Multiple Android Smartphones—0
Multimodal Cinematic Video Synthesis Using Text-to-Image and Audio Generation Models—0
ReVISE: Self-Supervised Speech Resynthesis with Visual Input for Universal and Generalized Speech Enhancement—0
ReVISE: Self-Supervised Speech Resynthesis With Visual Input for Universal and Generalized Speech Regeneration—0
Applying Automated Machine Translation to Educational Video Courses—0
Video alignment using unsupervised learning of local and global features—0
AV-Link: Temporally-Aligned Diffusion Features for Cross-Modal Audio-Video Generation—0
Self-supervised learning for audio-visual speaker diarization—0
Bronchoscopic video synchronization for interactive multimodal inspection of bronchial lesions—0
Show:102550

No leaderboard results yet.