SOTAVerified

Object Localization

Object Localization is the task of locating an instance of a particular object category in an image, typically by specifying a tightly cropped bounding box centered on the instance. An object proposal specifies a candidate bounding box, and an object proposal is said to be a correct localization if it sufficiently overlaps a human-labeled “ground-truth” bounding box for the given object. In the literature, the “Object Localization” task is to locate one instance of an object category, whereas “object detection” focuses on locating all instances of a category in a given image.

Source: Fast On-Line Kernel Density Estimation for Active Object Localization

Papers

Showing 251–300 of 617 papers

TitleStatusHype
Learning to Terminate in Object NavigationCode0
A Smoother Way to Train Structured Prediction ModelsCode0
PixelCAM: Pixel Class Activation Mapping for Histology Image Classification and ROI LocalizationCode0
Discriminating Known From Unknown Objects via Structure-Enhanced Recurrent Variational AutoEncoderCode0
Personal Fixations-Based Object Segmentation with Object Localization and Boundary PreservationCode0
Trade-offs in Fine-tuned Diffusion Models Between Accuracy and InterpretabilityCode0
Dilated Residual NetworksCode0
PEEKABOO: Hiding parts of an image for unsupervised object localizationCode0
Attributional Robustness Training using Input-Gradient Spatial AlignmentCode0
A Simple Single-Scale Vision Transformer for Object Localization and Instance SegmentationCode0
Object Detectors Emerge in Deep Scene CNNsCode0
Detecting Lesion Bounding Ellipses With Gaussian Proposal NetworksCode0
Adversarial Normalization: I Can Visualize Everything (ICE)Code0
Object Detection via a Multi-Region and Semantic Segmentation-Aware CNN ModelCode0
Object detection via a multi-region & semantic segmentation-aware CNN modelCode0
One-Shot General Object LocalizationCode0
DenseTrack: Drone-based Crowd Tracking via Density-aware Motion-appearance SynergyCode0
Multispectral Detection Transformer with Infrared-Centric Sensor FusionCode0
MonoGRNet: A Geometric Reasoning Network for Monocular 3D Object LocalizationCode0
DeNet: Scalable Real-time Object Detection with Directed Sparse SamplingCode0
BroadCAM: Outcome-agnostic Class Activation Mapping for Small-scale Weakly Supervised ApplicationsCode0
In-sample Contrastive Learning and Consistent Attention for Weakly Supervised Object LocalizationCode0
Min-Entropy Latent Model for Weakly Supervised Object DetectionCode0
Deep Weakly-Supervised Learning Methods for Classification and Localization in Histology Images: A SurveyCode0
Pairwise Similarity Knowledge Transfer for Weakly Supervised Object LocalizationCode0
A Novel Confidence Induced Class Activation Mapping for MRI Brain Tumor SegmentationCode0
Masked Multi-Query Slot Attention for Unsupervised Object DiscoveryCode0
MB-ORES: A Multi-Branch Object Reasoner for Visual Grounding in Remote SensingCode0
Improving Object Localization with Fitness NMS and Bounded IoU LossCode0
Adversarial Complementary Learning for Weakly Supervised Object LocalizationCode0
Localizing Infinity-shaped fishes: Sketch-guided object localization in the wildCode0
Learning Transferable Reward for Query Object Localization with Policy AdaptationCode0
Leveraging Transformers for Weakly Supervised Object Localization in Unconstrained VideosCode0
Explaining image classifiers by removing input features using generative modelsCode0
Soft Proposal Networks for Weakly Supervised Object LocalizationCode0
Progressive Domain Adaptation with Contrastive Learning for Object Detection in the Satellite Imagery—0
I3DOD: Towards Incremental 3D Object Detection via Prompting—0
How spatial frequencies and color drive object search in real-world scenes: A new eye-movement corpus—0
Deep Learning for Weakly-Supervised Object Detection and Object Localization: A Survey—0
How semantic and geometric information mutually reinforce each other in ToF object localization—0
How hard can it be? Estimating the difficulty of visual search in an image—0
Deep learning architectures for automated image segmentation—0
Deep Joint Task Learning for Generic Object Extraction—0
Bootstrapping Labelled Dataset Construction for Cow Tracking and Behavior Analysis—0
HiLM-D: Towards High-Resolution Understanding in Multimodal Large Language Models for Autonomous Driving—0
Hierarchical Complementary Learning for Weakly Supervised Object Localization—0
Deep Contextual Attention for Human-Object Interaction Detection—0
Heterogeneous Grid Convolution for Adaptive, Efficient, and Controllable Computation—0
Hand-Priming in Object Localization for Assistive Egocentric Vision—0
GTA: Guided Transfer of Spatial Attention from Object-Centric Representations—0
Show:102550
← PrevPage 6 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1OSMaNRGSPL32.99—Unverified
2SUSARGSPL27.31—Unverified
3ShanksRGSPL22.85—Unverified
4CVPR22RGSPL22.06—Unverified
5damm1RGSPL15.96—Unverified
61637RGSPL14.03—Unverified
7init. PREVALENTRGSPL13.51—Unverified
8AirbertRGSPL13.28—Unverified
9init. OSCARRGSPL10—Unverified
10SIARGSPL9.2—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP89.35—Unverified
2VoxelNetAP89.35—Unverified
3Frustum PointNetsAP88.7—Unverified
4Frustum PointNetsAP81.2—Unverified
5VoxelNetAP77.47—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP48.3—Unverified
2Frustum PointNetsAP47.2—Unverified
3Frustum PointNetsAP40.23—Unverified
4VoxelNetAP38.11—Unverified
5VoxelNetAP31.51—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP52.23—Unverified
2Frustum PointNetsAP50.22—Unverified
3Frustum PointNetsAP42.15—Unverified
4VoxelNetAP40.74—Unverified
5VoxelNetAP33.69—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP77.39—Unverified
2Frustum PointNetsAP75.33—Unverified
3Frustum PointNetsAP62.19—Unverified
4VoxelNetAP57.73—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP75.38—Unverified
2Frustum PointNetsAP71.96—Unverified
3VoxelNetAP66.7—Unverified
4VoxelNetAP61.22—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP61.96—Unverified
2Frustum PointNetsAP56.77—Unverified
3VoxelNetAP54.76—Unverified
4VoxelNetAP48.36—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP58.09—Unverified
2Frustum PointNetsAP51.21—Unverified
3VoxelNetAP46.13—Unverified
4VoxelNetAP39.48—Unverified
#ModelMetricClaimedVerifiedStatus
1Unified-IOXLLocalization (ablation)67—Unverified
2GPV-2Localization (ablation)53.6—Unverified
3Mask R-CNNLocalization (ablation)44.7—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP54.68—Unverified
2VoxelNeAP50.55—Unverified
3Frustum PointNetsAP50.39—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT4-Vision 4-shot+CoTAccuracy49.7—Unverified
2Gemini-Pro 4-shot+CoTAccuracy33.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP84—Unverified
2VoxelNetAP79.26—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP60.98—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossPrecision88.1—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc41.2—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc47.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossF-Score88.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossRecall89.2—Unverified