SOTAVerified

Action Localization

Action Localization is finding the spatial and temporal co ordinates for an action in a video. An action localization model will identify which frame an action start and ends in video and return the x,y coordinates of an action. Further the co ordinates will change when the object performing action undergoes a displacement.

Papers

Showing 201–250 of 369 papers

TitleStatusHype
Improving Action Localization by Progressive Cross-stream Cooperation—0
IMUVIE: Pickup Timeline Action Localization via Motion Movies—0
JCDNet: Joint of Common and Definite phases Network for Weakly Supervised Temporal Action Localization—0
Learning Actionness via Long-range Temporal Order Verification—0
Actor-centered Representations for Action Localization in Streaming Videos—0
Learning and Transferring Mid-Level Image Representations using Convolutional Neural Networks—0
Learning Discriminative Motion Features Through Detection—0
Learning Higher-order Object Interactions for Keypoint-based Video Understanding—0
Learning to Refactor Action and Co-occurrence Features for Temporal Action Localization—0
Learning to track for spatio-temporal action localization—0
LLM-powered Query Expansion for Enhancing Boundary Prediction in Language-driven Action Localization—0
Localizing Actions from Video Labels and Pseudo-Annotations—0
Localizing Moments of Actions in Untrimmed Videos of Infants with Autism Spectrum Disorder—0
Relevance Detection in Cataract Surgery Videos by Spatio-Temporal Action Localization—0
Rethinking Pseudo-Label Guided Learning for Weakly Supervised Temporal Action Localization from the Perspective of Noise Correction—0
Rethinking the Faster R-CNN Architecture for Temporal Action Localization—0
Rethinking Top Probability from Multi-view for Distracted Driver Behaviour Localization—0
Revisiting Kernel Temporal Segmentation as an Adaptive Tokenizer for Long-form Video Understanding—0
SALAD: Self-Assessment Learning for Action Detection—0
Scale Matters: Temporal Scale Aggregation Network for Precise Action Localization in Untrimmed Videos—0
MM-SEAL: A Large-scale Video Dataset of Multi-person Multi-grained Spatio-temporally Action Localization—0
Self-supervised Multi-actor Social Activity Understanding in Streaming Videos—0
Self-supervised Spatiotemporal Representation Learning by Exploiting Video Continuity—0
Semi-Supervised Pipe Video Temporal Defect Interval Localization—0
Slow Motion Matters: A Slow Motion Enhanced Network for Weakly Supervised Temporal Action Localization—0
Social Scene Understanding: End-to-End Multi-Person Action Localization and Collective Activity Recognition—0
Spatial-Aware Object Embeddings for Zero-Shot Localization and Classification of Actions—0
Spatio-Temporal Action Localization in a Weakly Supervised Setting—0
Spatio-temporal Action Recognition: A Survey—0
Frequency Selective Augmentation for Video Representation Learning—0
Spatio-Temporal Instance Learning: Action Tubes from Class Supervision—0
Structured Video-Language Modeling with Temporal Grouping and Spatial Grounding—0
Spot On: Action Localization from Pointly-Supervised Proposals—0
STAT: Towards Generalizable Temporal Action Localization—0
Stitch Contrast and Segment_Learning a Human Action Segmentation Model Using Trimmed Skeleton Videos—0
Sub-action Prototype Learning for Point-level Weakly-supervised Temporal Action Localization—0
Submission to ActivityNet Challenge 2019: Task B Spatio-temporal Action Localization—0
Survey of Action Recognition, Spotting and Spatio-Temporal Localization in Soccer -- Current Trends and Research Perspectives—0
Temporal Action Localization by Structured Maximal Sums—0
Temporal Action Localization using Long Short-Term Dependency—0
Temporal Action Localization with Global Segmentation Mask Transformers—0
Temporal Action Localization with Multi-temporal Scales—0
Temporal Action Localization With Pyramid of Score Distribution Features—0
Temporal Action Localization with Variance-Aware Networks—0
Temporal Action Proposal Generation with Transformers—0
Temporal Convolution Based Action Proposal: Submission to ActivityNet 2017—0
Temporal Fusion Network for Temporal Action Localization:Submission to ActivityNet Challenge 2020 (Task E)—0
Temporal Perceiving Video-Language Pre-training—0
P2ANet: A Dataset and Benchmark for Dense Action Detection from Table Tennis Match Broadcasting Videos—0
Three Birds with One Stone: Multi-Task Temporal Action Detection via Recycling Temporal Annotations—0
Show:102550
← PrevPage 5 of 8Next →

No leaderboard results yet.