SOTAVerified

Visual Tracking

Visual Tracking is an essential and actively researched problem in the field of computer vision with various real-world applications such as robotic services, smart surveillance systems, autonomous driving, and human-computer interaction. It refers to the automatic estimation of the trajectory of an arbitrary target object, usually specified by a bounding box in the first frame, as it moves around in subsequent video frames.

Source: Learning Reinforced Attentional Representation for End-to-End Visual Tracking

Papers

Showing 126–150 of 525 papers

TitleStatusHype
Technical Report for ReID-SAM on SkiTB Visual Tracking Challenge 2025—0
CFTrack: Enhancing Lightweight Visual Tracking through Contrastive Learning and Feature Matching—0
Enhanced Transformer-Based Tracking for Skiing Events: Overcoming Multi-Camera Challenges, Scale Variations and Rapid Motion -- SkiTB Visual Tracking Challenge 2025—0
DreamTrack: Dreaming the Future for Multimodal Visual Object Tracking—0
Exploring Historical Information for RGBE Visual Tracking with Mamba—0
Autoregressive Sequential Pretraining for Visual Tracking—0
FusionSORT: Fusion Methods for Online Multi-object Visual TrackingCode0
Improving Accuracy and Generalization for Efficient Visual Tracking—0
ChatTracker: Enhancing Visual Tracking Performance via Chatting with Multimodal Large Language Model—0
IP-MOT: Instance Prompt Learning for Cross-Domain Multi-Object Tracking—0
The Solution for Single Object Tracking Task of Perception Test Challenge 2024—0
Distilling Channels for Efficient Deep Tracking—0
Camouflaged Object Tracking: A BenchmarkCode0
Diff-Tracker: Text-to-Image Diffusion Models are Unsupervised Trackers—0
Tracking Reflected Objects: A BenchmarkCode0
Learning Motion Blur Robust Vision Transformers with Dynamic Early Exit for Real-Time UAV TrackingCode0
Adaptively Bypassing Vision Transformer Blocks for Efficient Visual TrackingCode0
Robust Visual Tracking via Iterative Gradient Descent and Threshold Selection—0
DTLLM-VLT: Diverse Text Generation for Visual Language Tracking Based on LLM—0
Learning Tracking Representations from Single Point Annotations—0
Empowering Embodied Visual Tracking with Visual Foundation Models and Offline RL—0
Multi-attention Associate Prediction Network for Visual Tracking—0
Pedestrian Tracking with Monocular Camera using Unconstrained 3D Motion Model—0
A Spectrum-based Image Denoising Method with Edge Feature Enhancement—0
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers—0
Show:102550
← PrevPage 6 of 21Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ARTrack-LAUC60.3—Unverified
2UNINEXT-HAUC59.3—Unverified
3JointNLTAUC56.9—Unverified
4OSTrackAUC55.9—Unverified
5TransTAUC50.7—Unverified
6AdaSwitcherAUC42—Unverified
#ModelMetricClaimedVerifiedStatus
1TAPIR (Panning MOVi-E)Average Jaccard61.3—Unverified
2TAPIR (MOVi-E)Average Jaccard59.8—Unverified
#ModelMetricClaimedVerifiedStatus
1TAPIR (Panning MOVi-E)Average Jaccard57.2—Unverified
2TAPIR (MOVi-E)Average Jaccard57.1—Unverified
#ModelMetricClaimedVerifiedStatus
1TAPIR (Panning MOVi-E)Average Jaccard84.7—Unverified
2TAPIR (MOVi-E)Average Jaccard84.3—Unverified
#ModelMetricClaimedVerifiedStatus
1TAPIR (MOVi-E)Average Jaccard66.2—Unverified
2TAPIR (Panning MOVi-E)Average Jaccard62.7—Unverified
#ModelMetricClaimedVerifiedStatus
1TATrack-LAUC71.1—Unverified
#ModelMetricClaimedVerifiedStatus
1SiamFC-lu (Ours)AUC0.32—Unverified
#ModelMetricClaimedVerifiedStatus
1SiamFC-lu (Ours)AUC0.66—Unverified
#ModelMetricClaimedVerifiedStatus
1MDNetScore0.64—Unverified
#ModelMetricClaimedVerifiedStatus
1TATrack-LACCURACY0.85—Unverified