SOTAVerified

Text Retrieval

Text Retrieval is the task of finding the most text result (such as an answer, paragraph, or passage) given a query (which could be a question, keywords, or any relevant text)

Papers

Showing 401–425 of 671 papers

TitleStatusHype
Learning Audio-guided Video Representation with Gated Attention for Video-Text Retrieval—0
Learning Context-Adapted Video-Text Retrieval by Attending to User Comments—0
Learning Joint Visual Semantic Matching Embeddings for Language-guided Retrieval—0
Learning Multi-Modal Nonlinear Embeddings: Performance Bounds and an Algorithm—0
Learning to embed semantic similarity for joint image-text retrieval—0
Learning with Noisy Correspondence—0
Lecture Presentations Multimodal Dataset: Towards Understanding Multimodality in Educational Videos—0
Leveraging Generative Language Models for Weakly Supervised Sentence Component Analysis in Video-Language Joint Learning—0
Multimodal Adversarial Defense for Vision-Language Models by Leveraging One-To-Many Relationships—0
Lifelong learning for text retrieval and recognition in historical handwritten document collections—0
LightCLIP: Learning Multi-Level Interaction for Lightweight Vision-Language Models—0
Linq-Embed-Mistral Technical Report—0
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning—0
Look, Imagine and Match: Improving Textual-Visual Cross-Modal Retrieval with Generative Models—0
LoopITR: Combining Dual and Cross Encoder Architectures for Image-Text Retrieval—0
LSTM-based Selective Dense Text Retrieval Guided by Sparse Lexical Retrieval—0
LuoJiaHOG: A Hierarchy Oriented Geo-aware Image Caption Dataset for Remote Sensing Image-Text Retrival—0
LV-MAE: Learning Long Video Representations through Masked-Embedding Autoencoders—0
M2D2: Exploring General-purpose Audio-Language Representations Beyond CLAP—0
Mamba Retriever: Utilizing Mamba for Effective and Efficient Dense Retrieval—0
MAMO: Masked Multimodal Modeling for Fine-Grained Vision-Language Representation Learning—0
Masked Contrastive Pre-Training for Efficient Video-Text Retrieval—0
Mask to reconstruct: Cooperative Semantics Completion for Video-text Retrieval—0
MASS: Overcoming Language Bias in Image-Text Matching—0
Maximal Matching Matters: Preventing Representation Collapse for Robust Cross-Modal Retrieval—0
Show:102550
← PrevPage 17 of 27Next →

No leaderboard results yet.