SOTAVerified

Action Localization

Action Localization is finding the spatial and temporal co ordinates for an action in a video. An action localization model will identify which frame an action start and ends in video and return the x,y coordinates of an action. Further the co ordinates will change when the object performing action undergoes a displacement.

Papers

Showing 251–300 of 369 papers

TitleStatusHype
Three Branches: Detecting Actions With Richer Features—0
Towards Adaptive Pseudo-label Learning for Semi-Supervised Temporal Action Localization—0
Transferable Knowledge-Based Multi-Granularity Aggregation Network for Temporal Action Localization: Submission to ActivityNet Challenge 2021—0
Trimmed Action Recognition, Dense-Captioning Events in Videos, and Spatio-temporal Action Localization with Focus on ActivityNet Challenge 2019—0
Tubelets: Unsupervised action proposals from spatiotemporal super-voxels—0
Two-Stream Consensus Network for Weakly-Supervised Temporal Action Localization—0
Two-Stream Consensus Network: Submission to HACS Challenge 2021 Weakly-Supervised Learning Track—0
Two-Stream Networks for Weakly-Supervised Temporal Action Localization With Semantic-Aware Mechanisms—0
Unified Keypoint-based Action Recognition Framework via Structured Keypoint Pooling—0
Unsupervised Action Discovery and Localization in Videos—0
Unsupervised Action Localization Crop in Video Retargeting for 3D ConvNets—0
Unsupervised Domain Adaptation for Spatio-Temporal Action Localization—0
VideoCapsuleNet: A Simplified Network for Action Detection—0
VideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding—0
Video-Specific Query-Key Attention Modeling for Weakly-Supervised Temporal Action Localization—0
vireoJD-MM at Activity Detection in Extended Videos—0
Visual-Textual Capsule Routing for Text-Based Video Segmentation—0
ViTALS: Vision Transformer for Action Localization in Surgical Nephrectomy—0
Weakly-Supervised Action Localization and Action Recognition using Global-Local Attention of 3D CNN—0
Weakly-Supervised Action Localization by Hierarchically-structured Latent Attention Modeling—0
Weakly-supervised Action Localization with Background Modeling—0
Weakly Supervised Gaussian Networks for Action Detection—0
Weakly-Supervised Multi-Person Action Recognition in 360^ Videos—0
Weakly Supervised Temporal Action Localization Through Contrast Based Evaluation Networks—0
Weakly Supervised Temporal Action Localization with Segment-Level Labels—0
Weakly Supervised Temporal Action Localization Through Learning Explicit Subspaces for Action and Context—0
Weakly-Supervised Temporal Action Localization Through Local-Global Background Modeling—0
Weakly Supervised Temporal Action Localization via Dual-Prior Collaborative Learning Guided by Multimodal Large Language Models—0
What do I Annotate Next? An Empirical Study of Active Learning for Action Localization—0
What If We Do Not Have Multiple Videos of the Same Action? -- Video Action Localization Using Web Images—0
YH Technologies at ActivityNet Challenge 2018—0
You Ought to Look Around: Precise, Large Span Action Detection—0
Zero-shot Action Localization via the Confidence of Large Vision-Language Models—0
OWL (Observe, Watch, Listen): Audiovisual Temporal Context for Localizing Actions in Egocentric Videos—0
PcmNet: Position-Sensitive Context Modeling Network for Temporal Action Localization—0
PivoTAL: Prior-Driven Supervision for Weakly-Supervised Temporal Action Localization—0
PLOT-TAL -- Prompt Learning with Optimal Transport for Few-Shot Temporal Action Localization—0
Point3D: tracking actions as moving points with 3D CNNs—0
Point-Level Temporal Action Localization: Bridging Fully-supervised Proposals to Weakly-supervised Losses—0
Pointly-Supervised Action Localization—0
POTLoc: Pseudo-Label Oriented Transformer for Point-Supervised Temporal Action Localization—0
Precise Temporal Action Localization by Evolving Temporal Proposals—0
Predicting the Where and What of Actors and Actions Through Online Action Localization—0
Prior-enhanced Temporal Action Localization using Subject-aware Spatial Attention—0
Progress Regression RNN for Online Spatial-Temporal Action Localization in Unconstrained Videos—0
Proposal-based Temporal Action Localization with Point-level Supervision—0
ProTAL: A Drag-and-Link Video Programming Framework for Temporal Action Localization—0
Real-time Spatio-temporal Action Localization via Learning Motion Representation—0
Relation Modeling in Spatio-Temporal Action Localization—0
Object Priors for Classifying and Localizing Unseen ActionsCode0
Show:102550
← PrevPage 6 of 8Next →

No leaderboard results yet.