SOTAVerified

Action Anticipation

Next action anticipation is defined as observing 1, ... , T frames and predicting the action that happens after a gap of T_a seconds. It is important to note that a new action starts after T_a seconds that is not seen in the observed frames. Here T_a=1 second.

Papers

Showing 51–100 of 110 papers

TitleStatusHype
On the Efficacy of Text-Based Input Modalities for Action Anticipation—0
Uncertainty-aware Action Decoupling Transformer for Action Anticipation—0
PALM: Predicting Actions through Language Models—0
DiffAnt: Diffusion Models for Action Anticipation—0
Object-centric Video Representation for Long-term Action AnticipationCode0
A Survey on Deep Learning Techniques for Action Anticipation—0
JOADAA: joint online action detection and action anticipation—0
Knowledge-Guided Short-Context Action Anticipation in Human-Centric Videos—0
Leveraging Next-Active Objects for Context-Aware Anticipation in Egocentric Videos—0
Multiscale Video Pretraining for Long-Term Activity Forecasting—0
VS-TransGRU: A Novel Transformer-GRU-based Framework Enhanced by Visual-Semantic Fusion for Egocentric Action Anticipation—0
Technical Report for Ego4D Long Term Action Anticipation Challenge 2023Code0
Streaming egocentric action anticipation: An evaluation scheme and approach—0
Analysis over vision-based models for pedestrian action anticipation—0
Enhancing Next Active Object-based Egocentric Action Anticipation with Guided AttentionCode0
Therbligs in Action: Video Understanding through Motion Primitives—0
Off-Policy Action Anticipation in Multi-Agent Reinforcement Learning—0
Fine-grained Affordance Annotation for Egocentric Hand-Object Interaction VideosCode0
Leveraging Temporal Context in Low Representational Power Regimes—0
Inductive Attention for Video Action Anticipation—0
Interaction Region Visual Transformer for Egocentric Action AnticipationCode0
Text-Derived Knowledge Helps Vision: A Simple Cross-modal Distillation for Video-based Action AnticipationCode0
MECCANO: A Multimodal Egocentric Dataset for Humans Behavior Understanding in the Industrial-like Domain—0
Predicting the Next Action by Modeling the Abstract GoalCode0
1st Place Solution to the EPIC-Kitchens Action Anticipation Challenge 2022—0
NVIDIA-UNIBZ Submission for EPIC-KITCHENS-100 Action Anticipation Challenge 2022—0
Precise Affordance Annotation for Egocentric Action Video Datasets—0
Unified Recurrence Modeling for Video Action AnticipationCode0
A-ACT: Action Anticipation through Cycle Transformations—0
Assembly101: A Large-Scale Multi-View Video Dataset for Understanding Procedural ActivitiesCode0
Untrimmed Action Anticipation—0
Weakly-Supervised Dense Action AnticipationCode0
Towards Streaming Egocentric Action Anticipation—0
Learning to Discriminate Information for Online Action Detection: Analysis and Application—0
SlowFast Rolling-Unrolling LSTMs for Action Anticipation in Egocentric Videos—0
Shifted Chunk Transformer for Spatio-Temporal Representational Learning—0
TransAction: ICL-SJTU Submission to EPIC-Kitchens Action Anticipation Challenge 2021Code0
Multi-Modal Temporal Convolutional Network for Anticipating Actions in Egocentric Videos—0
Anticipating human actions by correlating past with the future with Jaccard similarity measures—0
Forecasting Action through Contact Representations from First Person Video—0
Learning to Anticipate Egocentric Actions by Imagination—0
Deep Sequence Learning for Video Anticipation: From Discrete and Deterministic to Continuous and Stochastic—0
Egocentric Object Manipulation Graphs—0
Knowledge Distillation for Action Anticipation via Label Smoothing—0
TTPP: Temporal Transformer with Progressive Prediction for Efficient Action Anticipation—0
Predicting the Future: A Jointly Learnt Model for Action Anticipation—0
HalluciNet-ing Spatiotemporal Representations Using a 2D-CNNCode0
Forecasting Human-Object Interaction: Joint Prediction of Motor Attention and Actions in First Person VideoCode0
Action Anticipation with RBF Kernelized Feature Mapping RNN—0
Action Anticipation for Collaborative Environments: The Impact of Contextual Information and Uncertainty-Based Prediction—0
Show:102550
← PrevPage 2 of 3Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1PlausiVLRecall@527.6—Unverified
2InAViTRecall@525.89—Unverified
3UADTRecall@523—Unverified
4S-GEARRecall@519.9—Unverified
5AFFTRecall@518.5—Unverified
6MeMViT-24Recall@517.7—Unverified
7AVT+Recall@515.9—Unverified
8TempAggRecall@514.73—Unverified
9RU-LSTMRecall@513.94—Unverified
#ModelMetricClaimedVerifiedStatus
1InAViTrecall@523.75—Unverified
2AVT++recall@516.7—Unverified
3AFFTrecall@514.9—Unverified
4Abstract Goalrecall@514.29—Unverified
5AVT+recall@512.6—Unverified
6TempAggrecall@512.6—Unverified
7RULSTMrecall@511.2—Unverified
8TBNrecall@511—Unverified
#ModelMetricClaimedVerifiedStatus
1Abstract GoalTop 1 Accuracy - Act.22.03—Unverified
2AVT+Top 1 Accuracy - Act.16.84—Unverified
3ImagineRNNTop 1 Accuracy - Act.14.66—Unverified
4RULSTM [24, 23]Top 1 Accuracy - Act.14.39—Unverified
5EDTop 1 Accuracy - Act.8.08—Unverified
6ATSNTop 1 Accuracy - Act.6—Unverified
72SCNNTop 1 Accuracy - Act.4.32—Unverified
#ModelMetricClaimedVerifiedStatus
1Abstract GoalTop 1 Accuracy - Act.13.28—Unverified
2AVT+Top 1 Accuracy - Act.10.41—Unverified
3ImagineRNNTop 1 Accuracy - Act.9.25—Unverified
4RULSTM [24, 23]Top 1 Accuracy - Act.8.16—Unverified
5EDTop 1 Accuracy - Act.2.65—Unverified
6ATSNTop 1 Accuracy - Act.2.39—Unverified
72SCNNTop 1 Accuracy - Act.2.29—Unverified
#ModelMetricClaimedVerifiedStatus
1UADTTop-1 Accuracy68.4—Unverified
2InAViTTop-1 Accuracy67.8—Unverified
3Abstract GoalTop-1 Accuracy49.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Goal ConsistencyVerbs Recall@560.04—Unverified
2TempAggVerbs Recall@559.11—Unverified
#ModelMetricClaimedVerifiedStatus
1Action anticipation baseline (co-training, with gaze)Accuracy45.45—Unverified
2Action anticipation baseline (co-training, no gaze)Accuracy38.7—Unverified
#ModelMetricClaimedVerifiedStatus
1UADTTop-1 Accuracy62.7—Unverified