SOTAVerified

Object Localization

Object Localization is the task of locating an instance of a particular object category in an image, typically by specifying a tightly cropped bounding box centered on the instance. An object proposal specifies a candidate bounding box, and an object proposal is said to be a correct localization if it sufficiently overlaps a human-labeled “ground-truth” bounding box for the given object. In the literature, the “Object Localization” task is to locate one instance of an object category, whereas “object detection” focuses on locating all instances of a category in a given image.

Source: Fast On-Line Kernel Density Estimation for Active Object Localization

Papers

Showing 101–150 of 617 papers

TitleStatusHype
Progressive Coordinate Transforms for Monocular 3D Object DetectionCode1
CORA: Adapting CLIP for Open-Vocabulary Detection with Region Prompting and Anchor Pre-MatchingCode1
Group-Wise Learning for Weakly Supervised Semantic SegmentationCode1
Exploring Foveation and Saccade for Improved Weakly-Supervised LocalizationCode1
BEVNeXt: Reviving Dense BEV Frameworks for 3D Object DetectionCode1
Recognizing Vector Graphics without RasterizationCode1
Keep CALM and Improve Visual Feature AttributionCode1
CREAM: Weakly Supervised Object Localization via Class RE-Activation MappingCode1
UniTAB: Unifying Text and Box Outputs for Grounded Vision-Language ModelingCode1
RepPoints V2: Verification Meets Regression for Object DetectionCode1
Frustum-PointPillars: A Multi-Stage Approach for 3D Object Detection using RGB Camera and LiDARCode1
Few-shot Object LocalizationCode1
CutMix: Regularization Strategy to Train Strong Classifiers with Localizable FeaturesCode1
Faraway-Frustum: Dealing with Lidar Sparsity for 3D Object Detection using FusionCode1
Robust Object Detection in Remote Sensing Imagery with Noisy and Sparse Geo-Annotations (Full Version)Code1
DAFNe: A One-Stage Anchor-Free Approach for Oriented Object DetectionCode1
DanceTrack: Multi-Object Tracking in Uniform Appearance and Diverse MotionCode1
Scale-Invariant Fast Functional RegistrationCode1
Boosting Segment Anything Model Towards Open-Vocabulary LearningCode1
An Attention-guided Multistream Feature Fusion Network for Localization of Risky Objects in Driving VideosCode1
Boosting Weakly Supervised Object Detection via Learning Bounding Box AdjustersCode1
DeepCut: Unsupervised Segmentation using Graph Neural Networks ClusteringCode1
Generative Prompt Model for Weakly Supervised Object LocalizationCode1
Spatial-Aware Token for Weakly Supervised Object LocalizationCode1
EDN: Salient Object Detection via Extremely-Downsampled NetworkCode1
TDAM: Top-Down Attention Module for Contextually Guided Feature Selection in CNNsCode1
F-CAM: Full Resolution Class Activation Maps via Guided Parametric UpscalingCode1
TS-CAM: Token Semantic Coupled Attention Map for Weakly Supervised Object LocalizationCode1
Deep Learning Innovations for Underwater Waste Detection: An In-Depth AnalysisCode1
Dual-attention Guided Dropblock Module for Weakly Supervised Object LocalizationCode1
Distilling Knowledge from Refinement in Multiple Instance Detection NetworksCode1
Few-Shot Object Detection via Variational Feature AggregationCode1
FlightScope: An Experimental Comparative Review of Aircraft Detection Algorithms in Satellite ImageryCode1
Frustum PointNets for 3D Object Detection from RGB-D DataCode1
FDCNet: Feature Drift Compensation Network for Class-Incremental Weakly Supervised Object LocalizationCode1
Global-Local Collaborative Inference with LLM for Lidar-Based Open-Vocabulary DetectionCode1
Building Calibrated Deep Models via Uncertainty Matching with Auxiliary Interval PredictorsCode1
GRIT: General Robust Image Task BenchmarkCode1
Geometry Constrained Weakly Supervised Object LocalizationCode1
HINT: Hierarchical Neuron Concept ExplainerCode1
Improving Weakly-supervised Object Localization via Causal InterventionCode1
DETReg: Unsupervised Pretraining with Region Priors for Object DetectionCode1
Keep It SimPool: Who Said Supervised Transformers Suffer from Attention Deficit?Code1
MCTformer+: Multi-Class Token Transformer for Weakly Supervised Semantic SegmentationCode1
CAM Back Again: Large Kernel CNNs from a Weakly Supervised Object Localization PerspectiveCode1
Dual Attention U-Net with Feature Infusion: Pushing the Boundaries of Multiclass Defect SegmentationCode1
Cascade-DETR: Delving into High-Quality Universal Object DetectionCode1
Dual Progressive Transformations for Weakly Supervised Semantic SegmentationCode1
Discriminative Sounding Objects Localization via Self-supervised Audiovisual MatchingCode1
Point, Segment and Count: A Generalized Framework for Object CountingCode1
Show:102550
← PrevPage 3 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1OSMaNRGSPL32.99—Unverified
2SUSARGSPL27.31—Unverified
3ShanksRGSPL22.85—Unverified
4CVPR22RGSPL22.06—Unverified
5damm1RGSPL15.96—Unverified
61637RGSPL14.03—Unverified
7init. PREVALENTRGSPL13.51—Unverified
8AirbertRGSPL13.28—Unverified
9init. OSCARRGSPL10—Unverified
10SIARGSPL9.2—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP89.35—Unverified
2VoxelNetAP89.35—Unverified
3Frustum PointNetsAP88.7—Unverified
4Frustum PointNetsAP81.2—Unverified
5VoxelNetAP77.47—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP48.3—Unverified
2Frustum PointNetsAP47.2—Unverified
3Frustum PointNetsAP40.23—Unverified
4VoxelNetAP38.11—Unverified
5VoxelNetAP31.51—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP52.23—Unverified
2Frustum PointNetsAP50.22—Unverified
3Frustum PointNetsAP42.15—Unverified
4VoxelNetAP40.74—Unverified
5VoxelNetAP33.69—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP77.39—Unverified
2Frustum PointNetsAP75.33—Unverified
3Frustum PointNetsAP62.19—Unverified
4VoxelNetAP57.73—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP75.38—Unverified
2Frustum PointNetsAP71.96—Unverified
3VoxelNetAP66.7—Unverified
4VoxelNetAP61.22—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP61.96—Unverified
2Frustum PointNetsAP56.77—Unverified
3VoxelNetAP54.76—Unverified
4VoxelNetAP48.36—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP58.09—Unverified
2Frustum PointNetsAP51.21—Unverified
3VoxelNetAP46.13—Unverified
4VoxelNetAP39.48—Unverified
#ModelMetricClaimedVerifiedStatus
1Unified-IOXLLocalization (ablation)67—Unverified
2GPV-2Localization (ablation)53.6—Unverified
3Mask R-CNNLocalization (ablation)44.7—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP54.68—Unverified
2VoxelNeAP50.55—Unverified
3Frustum PointNetsAP50.39—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT4-Vision 4-shot+CoTAccuracy49.7—Unverified
2Gemini-Pro 4-shot+CoTAccuracy33.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP84—Unverified
2VoxelNetAP79.26—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP60.98—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossPrecision88.1—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc41.2—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc47.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossF-Score88.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossRecall89.2—Unverified