SOTAVerified

Caption Generation

Papers

Showing 201–225 of 310 papers

TitleStatusHype
Analysis of Convolutional Decoder for Image Caption Generation—0
An encoder-decoder based framework for hindi image caption generation—0
End-to-End Video Captioning—0
A Thorough Review on Recent Deep Learning Methodologies for Image Captioning—0
Attention-based transformer models for image captioning across languages: An in-depth survey and evaluation—0
Automated Audio Captioning: An Overview of Recent Progress and New Challenges—0
Benchmarking Multimodal Models for Ukrainian Language Understanding Across Academic and Cultural Domains—0
BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving—0
Bi-directional Contextual Attention for 3D Dense Captioning—0
VidCoM: Fast Video Comprehension through Large Language Models with Multimodal Tools—0
RealignDiff: Boosting Text-to-Image Diffusion Model with Coarse-to-fine Semantic Re-alignment—0
Bringing back simplicity and lightliness into neural image captioning—0
CapText: Large Language Model-based Caption Generation From Image Context and Description—0
Caption Generation of Robot Behaviors based on Unsupervised Learning of Action Segments—0
Chittron: An Automatic Bangla Image Captioning System—0
Clue: Cross-modal Coherence Modeling for Caption Generation—0
Common Subspace for Model and Similarity: Phrase Learning for Caption Generation From Images—0
Controlled Caption Generation for Images Through Adversarial Attacks—0
Cortico-cerebellar networks as decoupled neural interfaces—0
CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving—0
Cross-Lingual Image Caption Generation—0
Cross-modal Coherence Modeling for Caption Generation—0
D3Net: A Unified Speaker-Listener Architecture for 3D Dense Captioning and Visual Grounding—0
DECap: Towards Generalized Explicit Caption Editing via Diffusion Mechanism—0
Deep Bayesian Natural Language Processing—0
Show:102550
← PrevPage 9 of 13Next →

No leaderboard results yet.