SOTAVerified

Referring Expression

Referring expressions places a bounding box around the instance corresponding to the provided description and image.

Papers

Showing 251–300 of 364 papers

TitleStatusHype
Fuzzy Logic for Vagueness Management in Referring Expression Generation—0
Generalizable Entity Grounding via Assistance of Large Language Model—0
Generating Quantified Referring Expressions through Attention-Driven Incremental Perception—0
Generating Texts with Integer Linear Programming—0
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing—0
Gera \~ao de Express\~oes de Refer\^encia usando Rela \~oes Espaciais (Referring Expression Generation Using Spatial Relations) [in Portuguese]—0
Getting to ``Hearer-old'': Charting Referring Expressions Across Time—0
Give Me Something to Eat: Referring Expression Comprehension with Commonsense Knowledge—0
Goal-driven text descriptions for images—0
GOI: Find 3D Gaussians of Interest with an Optimizable Open-vocabulary Semantic-space Hyperplane—0
Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation—0
Griffon-G: Bridging Vision-Language and Vision-Centric Tasks via Large Multimodal Models—0
Griffon: Spelling out All Object Locations at Any Granularity with Large Language Models—0
G-TUNA: a corpus of referring expressions in German, including duration information—0
Harlequin: Color-driven Generation of Synthetic Data for Referring Expression Comprehension—0
Hierarchical Alignment-enhanced Adaptive Grounding Network for Generalized Referring Expression Comprehension—0
HOLM: Hallucinating Objects with Language Models for Referring Expression Recognition in Partially-Observed Scenes—0
Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities—0
Improving Referring Expression Grounding with Cross-modal Attention-guided Erasing—0
Improving the generation of personalised descriptions—0
Improving the Naturalness and Diversity of Referring Expression Generation models using Minimum Risk Training—0
Informativity in Image Captions vs. Referring Expressions—0
Instance-Aware Generalized Referring Expression Segmentation—0
Intrinsic Task-based Evaluation for Referring Expression Generation—0
Justifying Corpus-Based Choices in Referring Expression Generation—0
Key-Word-Aware Network for Referring Expression Image Segmentation—0
Language Controls More Than Top-Down Attention: Modulating Bottom-Up Visual Processing with Referring Expressions—0
Language-Guided 3D Object Detection in Point Cloud for Autonomous Driving—0
Language-Mediated, Object-Centric Representation Learning—0
Learning Distributions over Logical Forms for Referring Expression Generation—0
Learning Preferences for Referring Expression Generation: Effects of Domain, Language and Algorithm—0
Learning Pseudo-Labeler beyond Noun Concepts for Open-Vocabulary Object Detection—0
Learning to Generate Unambiguous Spatial Referring Expressions for Real-World Environments—0
Learning to Reason and Navigate: Parameter Efficient Action Planning with Large Language Models—0
Learning to Represent Image and Text with Denotation Graph—0
Learning Visual Grounding from Generative Vision and Language Model—0
Lessons from Computational Modelling of Reference Production in Mandarin and English—0
Leveraging Non-Specialists for Accurate and Time Efficient AMR Annotation—0
Leveraging Past References for Robust Language Grounding—0
LGD: Leveraging Generative Descriptions for Zero-Shot Referring Image Segmentation—0
Lite-MDETR: A Lightweight Multi-Modal Detector—0
Look Hear: Gaze Prediction for Speech-directed Human Attention—0
M^2IST: Multi-Modal Interactive Side-Tuning for Efficient Referring Expression Comprehension—0
MAGNet: Multi-Region Attention-Assisted Grounding of Natural Language Queries at Phrase Level—0
Make Graph-based Referring Expression Comprehension Great Again through Expression-guided Dynamic Gating and Regression—0
Mask-aware Text-to-Image Retrieval: Referring Expression Segmentation Meets Cross-modal Retrieval—0
MaskInversion: Localized Embeddings via Optimization of Explainability Maps—0
Meta Compositional Referring Expression Segmentation—0
Meteorologists and Students: A resource for language grounding of geographical descriptors—0
Modeling Semantic Expectation: Using Script Knowledge for Referent Prediction—0
Show:102550
← PrevPage 6 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Random[email protected]14.6—Unverified