SOTAVerified

cross-modal alignment

Papers

Showing 4150 of 342 papers

TitleStatusHype
Conditional Variational Autoencoder for Sign Language Translation with Cross-Modal AlignmentCode1
BrainVis: Exploring the Bridge between Brain and Visual Signals via Image ReconstructionCode1
Dynamic Modality Interaction Modeling for Image-Text RetrievalCode1
A Cross-Modal Approach to Silent Speech with LLM-Enhanced RecognitionCode1
AlignVSR: Audio-Visual Cross-Modal Alignment for Visual Speech RecognitionCode1
CAMANet: Class Activation Map Guided Attention Network for Radiology Report GenerationCode1
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Large Model EnhancementCode1
BiPVL-Seg: Bidirectional Progressive Vision-Language Fusion with Global-Local Alignment for Medical Image SegmentationCode1
DanceIt: Music-inspired Dancing Video SynthesisCode1
CVT-SLR: Contrastive Visual-Textual Transformation for Sign Language Recognition with Variational AlignmentCode1
Show:102550
← PrevPage 5 of 35Next →

No leaderboard results yet.