SOTAVerified

AudioCaps

Papers

Showing 1–10 of 64 papers

TitleStatusHype
GLAP: General contrastive audio-text pretraining across domains and languagesCode2
AC/DC: LLM-based Audio Comprehension via Dialogue Continuation—0
IMPACT: Iterative Mask-based Parallel Decoding for Text-to-Audio Generation with Diffusion Modeling—0
Mitigating Audiovisual Mismatch in Visual-Guide Audio Captioning—0
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion—0
DiffGAP: A Lightweight Diffusion Module in Contrastive Space for Bridging Cross-Model Gap—0
Quality Over Quantity? LLM-Based Curation for a Data-Efficient Audio-Video Foundation Model—0
TAIL: Text-Audio Incremental Learning—0
ATRI: Mitigating Multilingual Audio Text Retrieval Inconsistencies by Reducing Data Distribution ErrorsCode0
Unbiased Sliced Wasserstein Kernels for High-Quality Audio Captioning—0
Show:102550
← PrevPage 1 of 7Next →

No leaderboard results yet.