SOTAVerified

Action Classification

Papers

Showing 251–300 of 457 papers

TitleStatusHype
Unsupervised Video Understanding by Reconciliation of Posture Similarities—0
Multi-Fiber Networks for Video Recognition—0
Unsupervised View-Invariant Human Posture Representation—0
Multi-Level Sequence GAN for Group Activity Recognition—0
Multi-modal Prompting for Low-Shot Temporal Action Localization—0
Multi-Modal Three-Stream Network for Action Recognition—0
FastGRNN: A Fast, Accurate, Stable and Tiny Kilobyte Sized Gated Recurrent Neural Network—0
Multiview Transformers for Video Recognition—0
FASTER Recurrent Networks for Efficient Video Classification—0
FACTS: Fine-Grained Action Classification for Tactical Sports—0
Natural Language Descriptions of Human Activities Scenes: Corpus Generation and Analysis—0
Representation Learning on Visual-Symbolic Graphs for Video Understanding—0
Actor-Centric Relation Network—0
No More Shortcuts: Realizing the Potential of Temporal Self-Supervision—0
Evolving Space-Time Neural Architectures for Videos—0
Activity Driven Weakly Supervised Object Detection—0
ActionVLAD: Learning spatio-temporal aggregation for action classification—0
VicTR: Video-conditioned Text Representations for Activity Recognition—0
Ensembles of Deep Neural Networks for Action Recognition in Still Images—0
OmniVec2 - A Novel Transformer based Network for Large Scale Multimodal and Multitask Learning—0
OmniVec: Learning robust representations with cross modal sharing—0
OmniVL:One Foundation Model for Image-Language and Video-Language Tasks—0
Enhancing Video Transformers for Action Understanding with VLM-aided Training—0
End-to-end Generative Pretraining for Multimodal Video Captioning—0
End-to-End Fine-Grained Action Segmentation and Recognition Using Conditional Random Field Models and Discriminative Sparse Coding—0
Open Vocabulary Multi-Label Video Classification—0
Egocentric Audio-Visual Noise Suppression—0
Optimizing Average Precision using Weakly Supervised Data—0
OwlSight: A Robust Illumination Adaptation Framework for Dark Video Human Action Recognition—0
Efficient Two-Stream Motion and Appearance 3D CNNs for Video Classification—0
Efficient Optimization for Average Precision SVM—0
PERF-Net: Pose Empowered RGB-Flow Net—0
What do 15,000 Object Categories Tell Us About Classifying and Localizing Actions?—0
Point3D: tracking actions as moving points with 3D CNNs—0
YourSkatingCoach: A Figure Skating Video Benchmark for Fine-Grained Element Analysis—0
Pose is all you need: The pose only group activity recognition system (POGARS)—0
Efficient Feature Extraction, Encoding and Classification for Action Recognition—0
Predicting Action Tubes—0
PreViTS: Contrastive Pretraining with Video Tracking Supervision—0
Dual-Model Distillation for Efficient Action Classification with Hybrid Edge-Cloud Solution—0
Dual coordinate solvers for large-scale structural SVMs—0
VideoCapsuleNet: A Simplified Network for Action Detection—0
Proposal-based Temporal Action Localization with Point-level Supervision—0
Do not trust the neighbors! Adversarial Metric Learning for Self-Supervised Scene Flow Estimation—0
Proximal Control of UAVs with Federated Learning for Human-Robot Collaborative Domains—0
Domain-Specific Priors and Meta Learning for Few-Shot First-Person Action Recognition—0
How Much Does Audio Matter to Recognize Egocentric Object Interactions?—0
Domain Adaptation of VLM for Soccer Video Understanding—0
Action Verb Corpus—0
R-CNNs for Pose Estimation and Action Detection—0
Show:102550
← PrevPage 6 of 10Next →

No leaderboard results yet.