SOTAVerified

Object Localization

Object Localization is the task of locating an instance of a particular object category in an image, typically by specifying a tightly cropped bounding box centered on the instance. An object proposal specifies a candidate bounding box, and an object proposal is said to be a correct localization if it sufficiently overlaps a human-labeled “ground-truth” bounding box for the given object. In the literature, the “Object Localization” task is to locate one instance of an object category, whereas “object detection” focuses on locating all instances of a category in a given image.

Source: Fast On-Line Kernel Density Estimation for Active Object Localization

Papers

Showing 151–200 of 617 papers

TitleStatusHype
Distilling Knowledge from Refinement in Multiple Instance Detection NetworksCode1
A Generic Visualization Approach for Convolutional Neural NetworksCode1
OCDet: Object Center Detection via Bounding Box-Aware Heatmap Prediction on Edge Devices with NPUsCode1
Few-Shot Object Detection via Variational Feature AggregationCode1
Online Refinement of Low-level Feature Based Activation Map for Weakly Supervised Object LocalizationCode1
Open3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask GuidanceCode1
CIA-SSD: Confident IoU-Aware Single-Stage Object Detector From Point CloudCode1
Optical Flow boosts Unsupervised Localization and SegmentationCode1
InstanceRefer: Cooperative Holistic Understanding for Visual Grounding on Point Clouds through Instance Multi-level Contextual ReferringCode1
Dual-attention Guided Dropblock Module for Weakly Supervised Object LocalizationCode1
Dual Attention U-Net with Feature Infusion: Pushing the Boundaries of Multiclass Defect SegmentationCode1
Agent Journey Beyond RGB: Unveiling Hybrid Semantic-Spatial Environmental Representations for Vision-and-Language NavigationCode1
Dual Progressive Transformations for Weakly Supervised Semantic SegmentationCode1
Learning Deep Features for Discriminative LocalizationCode1
Meta-DETR: Image-Level Few-Shot Object Detection with Inter-Class Correlation ExploitationCode1
EDN: Salient Object Detection via Extremely-Downsampled NetworkCode1
MUSTER: A Multi-scale Transformer-based Decoder for Semantic SegmentationCode1
Egocentric Audio-Visual Object LocalizationCode1
Deep Learning for Weakly-Supervised Object Detection and Object Localization: A Survey—0
Bootstrapping Labelled Dataset Construction for Cow Tracking and Behavior Analysis—0
Deep learning architectures for automated image segmentation—0
Deep Joint Task Learning for Generic Object Extraction—0
How hard can it be? Estimating the difficulty of visual search in an image—0
Deep Contextual Attention for Human-Object Interaction Detection—0
DeepAdaIn-Net: Deep Adaptive Device-Edge Collaborative Inference for Augmented Reality—0
Adaptively Denoising Proposal Collection for Weakly Supervised Object Localization—0
How semantic and geometric information mutually reinforce each other in ToF object localization—0
Modelling Lips-State Detection Using CNN for Non-Verbal Communications—0
An Application of Deep Learning for Sweet Cherry Phenotyping using YOLO Object Detection—0
D2DF2WOD: Learning Object Proposals for Weakly-Supervised Object Detection via Progressive Domain Adaptation—0
BIV-Priv-Seg: Locating Private Content in Images Taken by People With Visual Impairments—0
Adaptively Denoising Proposal Collection forWeakly Supervised Object Localization—0
Cyclic Learning for Binaural Audio Generation and Localization—0
BirdSLAM: Monocular Multibody SLAM in Bird's-Eye View—0
A Model Generalization Study in Localizing Indoor Cows with COw LOcalization (COLO) dataset—0
Evaluating and Enhancing Trustworthiness of LLMs in Perception Tasks—0
How spatial frequencies and color drive object search in real-world scenes: A new eye-movement corpus—0
Cross-Modal Distillation for 2D/3D Multi-Object Discovery from 2D Motion—0
Beyond Object Categories: Multi-Attribute Reference Understanding for Visual Grounding—0
A Memory-Augmented Multi-Task Collaborative Framework for Unsupervised Traffic Accident Detection in Driving Videos—0
CPR++: Object Localization via Single Coarse Point Supervision—0
Adaptive Label Smoothing—0
Could We Generate Cytology Images from Histopathology Images? An Empirical Study—0
A Markerless Deep Learning-based 6 Degrees of Freedom PoseEstimation for with Mobile Robots using RGB Data—0
Hierarchical Complementary Learning for Weakly Supervised Object Localization—0
HiLM-D: Towards High-Resolution Understanding in Multimodal Large Language Models for Autonomous Driving—0
Cooperative Multi-Monostatic Sensing for Object Localization in 6G Networks—0
Adapting Mask-RCNN for Automatic Nucleus Segmentation—0
Few-shot Geometry-Aware Keypoint Localization—0
3DCNN-DQN-RNN: A Deep Reinforcement Learning Framework for Semantic Parsing of Large-scale 3D Point Clouds—0
Show:102550
← PrevPage 4 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1OSMaNRGSPL32.99—Unverified
2SUSARGSPL27.31—Unverified
3ShanksRGSPL22.85—Unverified
4CVPR22RGSPL22.06—Unverified
5damm1RGSPL15.96—Unverified
61637RGSPL14.03—Unverified
7init. PREVALENTRGSPL13.51—Unverified
8AirbertRGSPL13.28—Unverified
9init. OSCARRGSPL10—Unverified
10SIARGSPL9.2—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP89.35—Unverified
2VoxelNetAP89.35—Unverified
3Frustum PointNetsAP88.7—Unverified
4Frustum PointNetsAP81.2—Unverified
5VoxelNetAP77.47—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP48.3—Unverified
2Frustum PointNetsAP47.2—Unverified
3Frustum PointNetsAP40.23—Unverified
4VoxelNetAP38.11—Unverified
5VoxelNetAP31.51—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP52.23—Unverified
2Frustum PointNetsAP50.22—Unverified
3Frustum PointNetsAP42.15—Unverified
4VoxelNetAP40.74—Unverified
5VoxelNetAP33.69—Unverified
#ModelMetricClaimedVerifiedStatus
1VoxelNetAP77.39—Unverified
2Frustum PointNetsAP75.33—Unverified
3Frustum PointNetsAP62.19—Unverified
4VoxelNetAP57.73—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP75.38—Unverified
2Frustum PointNetsAP71.96—Unverified
3VoxelNetAP66.7—Unverified
4VoxelNetAP61.22—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP61.96—Unverified
2Frustum PointNetsAP56.77—Unverified
3VoxelNetAP54.76—Unverified
4VoxelNetAP48.36—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP58.09—Unverified
2Frustum PointNetsAP51.21—Unverified
3VoxelNetAP46.13—Unverified
4VoxelNetAP39.48—Unverified
#ModelMetricClaimedVerifiedStatus
1Unified-IOXLLocalization (ablation)67—Unverified
2GPV-2Localization (ablation)53.6—Unverified
3Mask R-CNNLocalization (ablation)44.7—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP54.68—Unverified
2VoxelNeAP50.55—Unverified
3Frustum PointNetsAP50.39—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT4-Vision 4-shot+CoTAccuracy49.7—Unverified
2Gemini-Pro 4-shot+CoTAccuracy33.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustum PointNetsAP84—Unverified
2VoxelNetAP79.26—Unverified
#ModelMetricClaimedVerifiedStatus
1Frustrum-PointPillarsAP60.98—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossPrecision88.1—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc41.2—Unverified
#ModelMetricClaimedVerifiedStatus
1oursCorLoc47.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossF-Score88.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Hausdorff LossRecall89.2—Unverified