SOTAVerified

Action Anticipation

Next action anticipation is defined as observing 1, ... , T frames and predicting the action that happens after a gap of T_a seconds. It is important to note that a new action starts after T_a seconds that is not seen in the observed frames. Here T_a=1 second.

Papers

Showing 51–100 of 110 papers

TitleStatusHype
Assembly101: A Large-Scale Multi-View Video Dataset for Understanding Procedural ActivitiesCode0
TTPP: Temporal Transformer with Progressive Prediction for Efficient Action Anticipation—0
Uncertainty-aware Action Decoupling Transformer for Action Anticipation—0
Untrimmed Action Anticipation—0
VEDIT: Latent Prediction Architecture For Procedural Video Representation Learning—0
VIENA2: A Driving Anticipation Dataset—0
Vision and Intention Boost Large Language Model in Long-Term Action Anticipation—0
Visual Forecasting by Imitating Dynamics in Natural Sequences—0
VS-TransGRU: A Novel Transformer-GRU-based Framework Enhanced by Visual-Semantic Fusion for Egocentric Action Anticipation—0
On the Efficacy of Text-Based Input Modalities for Action Anticipation—0
User-in-the-loop Evaluation of Multimodal LLMs for Activity Assistance—0
A-ACT: Action Anticipation through Cycle Transformations—0
ActFusion: a Unified Diffusion Model for Action Segmentation and Anticipation—0
Action Anticipation By Predicting Future Dynamic Images—0
Action Anticipation for Collaborative Environments: The Impact of Contextual Information and Uncertainty-Based Prediction—0
Action Anticipation with RBF Kernelized Feature Mapping RNN—0
Analysis over vision-based models for pedestrian action anticipation—0
Anticipating human actions by correlating past with the future with Jaccard similarity measures—0
Anticipation and next action forecasting in video: an end-to-end model with memory—0
A Survey on Deep Learning Techniques for Action Anticipation—0
Knowledge Distillation for Human Action Anticipation—0
Can't make an Omelette without Breaking some Eggs: Plausible Action Anticipation using Large Video-Language Models—0
Deep Sequence Learning for Video Anticipation: From Discrete and Deterministic to Continuous and Stochastic—0
Delving into 3D Action Anticipation from Streaming Videos—0
DiffAnt: Diffusion Models for Action Anticipation—0
Egocentric Object Manipulation Graphs—0
Forecasting Action through Contact Representations from First Person Video—0
Gaze-Guided Graph Neural Network for Action Anticipation Conditioned on Intention—0
HiMemFormer: Hierarchical Memory-Aware Transformer for Multi-Agent Action Anticipation—0
Human Action Anticipation: A Survey—0
VLM Agents Generate Their Own Memories: Distilling Experience into Embodied Programs of Thought—0
ICPR 2024 Competition on Rider Intention Prediction—0
Inductive Attention for Video Action Anticipation—0
Intention Action Anticipation Model with Guide-Feedback Loop Mechanism—0
JOADAA: joint online action detection and action anticipation—0
Knowledge Distillation for Action Anticipation via Label Smoothing—0
Knowledge-Guided Short-Context Action Anticipation in Human-Centric Videos—0
PALM: Predicting Actions through Language Models—0
Learning to Anticipate Egocentric Actions by Imagination—0
Learning to Discriminate Information for Online Action Detection: Analysis and Application—0
Learning to Generate Long-term Future Narrations Describing Activities of Daily Living—0
Leveraging Next-Active Objects for Context-Aware Anticipation in Egocentric Videos—0
Leveraging Temporal Context in Low Representational Power Regimes—0
MECCANO: A Multimodal Egocentric Dataset for Humans Behavior Understanding in the Industrial-like Domain—0
Multi-Modal Temporal Convolutional Network for Anticipating Actions in Egocentric Videos—0
Multiscale Video Pretraining for Long-Term Activity Forecasting—0
NVIDIA-UNIBZ Submission for EPIC-KITCHENS-100 Action Anticipation Challenge 2022—0
Off-Policy Action Anticipation in Multi-Agent Reinforcement Learning—0
1st Place Solution to the EPIC-Kitchens Action Anticipation Challenge 2022—0
PhilHumans: Benchmarking Machine Learning for Personal Health—0
Show:102550
← PrevPage 2 of 3Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1PlausiVLRecall@527.6—Unverified
2InAViTRecall@525.89—Unverified
3UADTRecall@523—Unverified
4S-GEARRecall@519.9—Unverified
5AFFTRecall@518.5—Unverified
6MeMViT-24Recall@517.7—Unverified
7AVT+Recall@515.9—Unverified
8TempAggRecall@514.73—Unverified
9RU-LSTMRecall@513.94—Unverified
#ModelMetricClaimedVerifiedStatus
1InAViTrecall@523.75—Unverified
2AVT++recall@516.7—Unverified
3AFFTrecall@514.9—Unverified
4Abstract Goalrecall@514.29—Unverified
5AVT+recall@512.6—Unverified
6TempAggrecall@512.6—Unverified
7RULSTMrecall@511.2—Unverified
8TBNrecall@511—Unverified
#ModelMetricClaimedVerifiedStatus
1Abstract GoalTop 1 Accuracy - Act.22.03—Unverified
2AVT+Top 1 Accuracy - Act.16.84—Unverified
3ImagineRNNTop 1 Accuracy - Act.14.66—Unverified
4RULSTM [24, 23]Top 1 Accuracy - Act.14.39—Unverified
5EDTop 1 Accuracy - Act.8.08—Unverified
6ATSNTop 1 Accuracy - Act.6—Unverified
72SCNNTop 1 Accuracy - Act.4.32—Unverified
#ModelMetricClaimedVerifiedStatus
1Abstract GoalTop 1 Accuracy - Act.13.28—Unverified
2AVT+Top 1 Accuracy - Act.10.41—Unverified
3ImagineRNNTop 1 Accuracy - Act.9.25—Unverified
4RULSTM [24, 23]Top 1 Accuracy - Act.8.16—Unverified
5EDTop 1 Accuracy - Act.2.65—Unverified
6ATSNTop 1 Accuracy - Act.2.39—Unverified
72SCNNTop 1 Accuracy - Act.2.29—Unverified
#ModelMetricClaimedVerifiedStatus
1UADTTop-1 Accuracy68.4—Unverified
2InAViTTop-1 Accuracy67.8—Unverified
3Abstract GoalTop-1 Accuracy49.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Goal ConsistencyVerbs Recall@560.04—Unverified
2TempAggVerbs Recall@559.11—Unverified
#ModelMetricClaimedVerifiedStatus
1Action anticipation baseline (co-training, with gaze)Accuracy45.45—Unverified
2Action anticipation baseline (co-training, no gaze)Accuracy38.7—Unverified
#ModelMetricClaimedVerifiedStatus
1UADTTop-1 Accuracy62.7—Unverified