SOTAVerified

Referring Expression

Referring expressions places a bounding box around the instance corresponding to the provided description and image.

Papers

Showing 126–150 of 364 papers

TitleStatusHype
Augmenting Robot Knowledge Consultants with Distributed Short Term Memory—0
A case study on context-bound referring expression generation—0
Give Me Something to Eat: Referring Expression Comprehension with Commonsense Knowledge—0
Getting to ``Hearer-old'': Charting Referring Expressions Across Time—0
Corpus-based Referring Expressions Generation—0
Gera \~ao de Express\~oes de Refer\^encia usando Rela \~oes Espaciais (Referring Expression Generation Using Spatial Relations) [in Portuguese]—0
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing—0
Cops-Ref: A new Dataset and Task on Compositional Referring Expression Comprehension—0
Assessing Neural Referential Form Selectors on a Realistic Multilingual Dataset—0
M^2IST: Multi-Modal Interactive Side-Tuning for Efficient Referring Expression Comprehension—0
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training—0
ArraMon: A Joint Navigation-Assembly Instruction Interpretation Task in Dynamic Environments—0
Generating Texts with Integer Linear Programming—0
Generating Quantified Referring Expressions through Attention-Driven Incremental Perception—0
3DResT: A Strong Baseline for Semi-Supervised 3D Referring Expression Segmentation—0
Generalizable Entity Grounding via Assistance of Large Language Model—0
Fuzzy Logic for Vagueness Management in Referring Expression Generation—0
Constructing Distributions of Variation in Referring Expression Type from Corpora for Model Evaluation—0
Fully and Weakly Supervised Referring Expression Segmentation with End-to-End Learning—0
From Objects to Anywhere: A Holistic Benchmark for Multi-level Visual Grounding in 3D Scenes—0
CoNAN: A Complementary Neighboring-based Attention Network for Referring Expression Generation—0
Look Hear: Gaze Prediction for Speech-directed Human Attention—0
MAGNet: Multi-Region Attention-Assisted Grounding of Natural Language Queries at Phrase Level—0
FLORA: Formal Language Model Enables Robust Training-free Zero-shot Object Referring Analysis—0
Computational Interpretations of Recency for the Choice of Referring Expressions in Discourse—0
Show:102550
← PrevPage 6 of 15Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Random[email protected]14.6—Unverified