SOTAVerified

Atari Games

The Atari 2600 Games task (and dataset) involves training an agent to achieve high game scores.

( Image credit: Playing Atari with Deep Reinforcement Learning )

Papers

Showing 401–425 of 625 papers

TitleStatusHype
Deep Reinforcement Learning Policies Learn Shared Adversarial Features Across MDPs—0
Deep Reinforcement Learning with Decorrelation—0
Deep Reinforcement Learning with Implicit Human Feedback—0
Deep Reinforcement Learning With Macro-Actions—0
Deep Reinforcement Learning with Quantum-inspired Experience Replay—0
Deep Reinforcement Learning with Spiking Q-learning—0
Adversary Agnostic Robust Deep Reinforcement Learning—0
Detecting Adversarial Directions in Deep Reinforcement Learning to Make Robust Decisions—0
Smaller World Models for Reinforcement Learning—0
Disentangling Controllable Object through Video Prediction Improves Visual Reinforcement Learning—0
Disentangling the Causes of Plasticity Loss in Neural Networks—0
Distributional Perturbation for Efficient Exploration in Distributional Reinforcement Learning—0
Distributional Reinforcement Learning for Efficient Exploration—0
Double A3C: Deep Reinforcement Learning on OpenAI Gym Games—0
Double Prioritized State Recycled Experience Replay—0
DQN with model-based exploration: efficient learning on environments with sparse rewards—0
DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization—0
DSAC-C: Constrained Maximum Entropy for Robust Discrete Soft-Actor Critic—0
Dynamic Frame skip Deep Q Network—0
Effects of Different Optimization Formulations in Evolutionary Reinforcement Learning on Diverse Behavior Generation—0
Efficient decorrelation of features using Gramian in Reinforcement Learning—0
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning—0
Efficient Entropy for Policy Gradient with Multidimensional Action Space—0
Memory Based Trajectory-conditioned Policies for Learning from Sparse Rewards—0
Efficiently Guiding Imitation Learning Agents with Human Gaze—0
Show:102550
← PrevPage 17 of 25Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GDI-H3(200M frames)Score864—Unverified
2GDI-H3Score864—Unverified
3GDI-I3Score864—Unverified
4GDI-I3(200M frames)Score864—Unverified
5Bootstrapped DQNScore855—Unverified
6FQFScore854.2—Unverified
7R2D2Score837.7—Unverified
8Ape-XScore800.9—Unverified
9Agent57Score790.4—Unverified
10IMPALA (deep)Score787.34—Unverified
#ModelMetricClaimedVerifiedStatus
1GDI-H3(200M frames)Score34—Unverified
2IQNScore34—Unverified
3NoisyNet-DuelingScore34—Unverified
4QR-DQN-1Score34—Unverified
5Go-ExploreScore34—Unverified
6GDI-I3Score34—Unverified
7GDI-H3Score34—Unverified
8TRPO-hashScore34—Unverified
9C51 noopScore33.9—Unverified
10ASL DDQNScore33.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Agent57Score580,328.14—Unverified
2QR-DQN-1Score572,510—Unverified
3R2D2Score408,850—Unverified
4IMPALA (deep)Score351,200.12—Unverified
5Ape-XScore302,391.3—Unverified
6A2C + SILScore104,975.6—Unverified
7MuZero (Res2 Adam)Score94,906.25—Unverified
8DreamerV2Score94,688—Unverified
9MuZeroScore72,276—Unverified
10DNAScore52,398—Unverified
#ModelMetricClaimedVerifiedStatus
1GDI-H3(200M frames)Score1,000,000—Unverified
2GDI-H3Score1,000,000—Unverified
3Agent57Score999,997.63—Unverified
4R2D2Score999,996.7—Unverified
5MuZeroScore999,976.52—Unverified
6MuZero (Res2 Adam)Score999,659.18—Unverified
7GDI-I3Score943,910—Unverified
8Ape-XScore392,952.3—Unverified
9C51 noopScore266,434—Unverified
10Duel noopScore50,254.2—Unverified