SOTAVerified

Text to Video Retrieval

She's gone I can't find her anywhere I'm looking everywhere for her Everywhere is dark

Papers

Showing 71–75 of 75 papers

TitleStatusHype
MDMMT-2: Multidomain Multimodal Transformer for Video Retrieval, One More Step Towards Generalization—0
CUPID: Adaptive Curation of Pre-training Data for Video-and-Language Representation Learning—0
Support-set bottlenecks for video-text representation learning—0
Retrieving and Highlighting Action with Spatiotemporal Reference—0
Noise Estimation Using Density Estimation for Self-Supervised Multimodal LearningCode0
Show:102550
← PrevPage 8 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1FROZEN-revisedmAP23.39—Unverified
2FROZEN-revised (two-stream)text-to-video R@112.8—Unverified
#ModelMetricClaimedVerifiedStatus
1CLIP4Cliptext-to-video R@144.5—Unverified
#ModelMetricClaimedVerifiedStatus
1X-CLIP (Cross-Lingual)R@132.3—Unverified