SOTAVerified

Image to text

Papers

Showing 126–150 of 246 papers

TitleStatusHype
TMCIR: Token Merge Benefits Composed Image Retrieval—0
TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP—0
Towards a Visual-Language Foundation Model for Computational Pathology—0
Transform-Retrieve-Generate: Natural Language-Centric Outside-Knowledge Visual Question Answering—0
TrojVLM: Backdoor Attack Against Vision Language Models—0
Turbo Learning for Captionbot and Drawingbot—0
Two-stream Hierarchical Similarity Reasoning for Image-text Matching—0
Uncertainty-based Cross-Modal Retrieval with Probabilistic Representations—0
Understanding the Effect of using Semantically Meaningful Tokens for Visual Representation Learning—0
UNITE-FND: Reframing Multimodal Fake News Detection through Unimodal Scene Translation—0
Using Inter-Sentence Diverse Beam Search to Reduce Redundancy in Visual Storytelling—0
Utilizing Resource-Rich Language Datasets for End-to-End Scene Text Recognition in Resource-Poor Languages—0
Vision-Braille: An End-to-End Tool for Chinese Braille Image-to-Text Translation—0
Visual Fact Checker: Enabling High-Fidelity Detailed Caption Generation—0
When are Lemons Purple? The Concept Association Bias of Vision-Language Models—0
X-Fusion: Introducing New Modality to Frozen Large Language Models—0
15M Multimodal Facial Image-Text Dataset—0
Ziya-Visual: Bilingual Large Vision-Language Model via Multi-Task Instruction Tuning—0
Towards Cross-modal Retrieval in Chinese Cultural Heritage Documents: Dataset and Solution—0
ABC: Achieving Better Control of Multimodal Embeddings using VLMs—0
Accept the Modality Gap: An Exploration in the Hyperbolic Space—0
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training—0
AICoderEval: Improving AI Domain Code Generation of Large Language Models—0
AI Recommendation System for Enhanced Customer Experience: A Novel Image-to-Text Method—0
An End-to-End Neural Network for Image-to-Audio Transformation—0
Show:102550
← PrevPage 6 of 10Next →

No leaderboard results yet.