SOTAVerified

OpenAI Gym

An open-source toolkit from OpenAI that implements several Reinforcement Learning benchmarks including: classic control, Atari, Robotics and MuJoCo tasks.

(Description by Evolutionary learning of interpretable decision trees)

(Image Credit: OpenAI Gym)

Papers

Showing 201–250 of 382 papers

TitleStatusHype
VisualEnv: visual Gym environments with Blender—0
Way Off-Policy Batch Deep Reinforcement Learning of Human Preferences in Dialog—0
Membership Inference Attacks Against Temporally Correlated Data in Deep Reinforcement Learning—0
Decision-Making in Reinforcement Learning—0
Zap Q-Learning With Nonlinear Function Approximation—0
myGym: Modular Toolkit for Visuomotor Robotic Tasks—0
Adaptive Planning with Generative Models under Uncertainty—0
ReaCritic: Large Reasoning Transformer-based DRL Critic-model Scaling For Heterogeneous Networks—0
Accelerating Reinforcement Learning with Suboptimal Guidance—0
A Closed-Loop Multi-perspective Visual Servoing Approach with Reinforcement Learning—0
A Comprehensive Guide to Combining R and Python code for Data Science, Machine Learning and Reinforcement Learning—0
Active Inference in Hebbian Learning Networks—0
Adaptive Droplet Routing in Digital Microfluidic Biochips Using Deep Reinforcement Learning—0
Adaptive Experience Selection for Policy Gradient—0
Adaptive Temporal Difference Learning with Linear Function Approximation—0
A Deep Reinforcement Learning Strategy for UAV Autonomous Landing on a Platform—0
A Dual Memory Structure for Efficient Use of Replay Memory in Deep Reinforcement Learning—0
Advantage Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning—0
Adversarial Body Shape Search for Legged Robots—0
Adversarial Exploration Strategy for Self-Supervised Imitation Learning—0
Adversarial joint attacks on legged robots—0
Affine Transport for Sim-to-Real Domain Adaptation—0
A Generalised Inverse Reinforcement Learning Framework—0
Airlift Challenge: A Competition for Optimizing Cargo Delivery—0
A Multi-Agent Reinforcement Learning Testbed for Cognitive Radio Applications—0
An Analysis of Reinforcement Learning for Malaria Control—0
An FPGA-Based On-Device Reinforcement Learning Approach using Online Sequential Learning—0
An Independent Study of Reinforcement Learning and Autonomous Driving—0
An Oracle and Observations for the OpenAI Gym / ALE Freeway Environment—0
AppBuddy: Learning to Accomplish Tasks in Mobile Apps via Reinforcement Learning—0
A Strategy-Oriented Bayesian Soft Actor-Critic Model—0
A Surrogate-Assisted Controller for Expensive Evolutionary Reinforcement Learning—0
Towards Understanding Asynchronous Advantage Actor-critic: Convergence and Linear Speedup—0
Asynchronous Deep Double Duelling Q-Learning for Trading-Signal Execution in Limit Order Book Markets—0
Attention Loss Adjusted Prioritized Experience Replay—0
ACPO: A Policy Optimization Algorithm for Average MDPs with Constraints—0
AWD3: Dynamic Reduction of the Estimation Bias—0
Balancing a CartPole System with Reinforcement Learning -- A Tutorial—0
Behavior Cloning in OpenAI using Case Based Reasoning—0
Benchmarking Algorithms from Machine Learning for Low-Budget Black-Box Optimization—0
BlockPuzzle - A Challenge in Physical Reasoning and Generalization for Robot Learning—0
Causal Repair of Learning-enabled Cyber-physical Systems—0
Challenging On Car Racing Problem from OpenAI gym—0
Closing the loop between neural network simulators and the OpenAI Gym—0
Cluster-based Sampling in Hindsight Experience Replay for Robotic Tasks (Student Abstract)—0
Combining Model-based and Model-free RL via Multi-step Control Variates—0
Concept and the implementation of a tool to convert industry 4.0 environments modeled as FSM to an OpenAI Gym wrapper—0
Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts—0
Continuous-time Value Function Approximation in Reproducing Kernel Hilbert Spaces—0
Controlling an Inverted Pendulum with Policy Gradient Methods-A Tutorial—0
Show:102550
← PrevPage 5 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1MEowAverage Return6,586.33—Unverified
2TD3Average Return5,942.55—Unverified
3SACAverage Return5,208.09—Unverified
4DDPGAverage Return1,712.12—Unverified
5PPOAverage Return608.97—Unverified
#ModelMetricClaimedVerifiedStatus
1SACAverage Return15,836.04—Unverified
2DDPGAverage Return14,934.86—Unverified
3TD3Average Return12,026.73—Unverified
4MEowAverage Return10,981.47—Unverified
5PPOAverage Return6,006.11—Unverified
#ModelMetricClaimedVerifiedStatus
1MEowAverage Return3,332.99—Unverified
2TD3Average Return3,319.98—Unverified
3SACAverage Return2,882.56—Unverified
4DDPGAverage Return1,290.24—Unverified
5PPOAverage Return790.77—Unverified
#ModelMetricClaimedVerifiedStatus
1MEowAverage Return6,923.22—Unverified
2SACAverage Return6,211.5—Unverified
3PPOAverage Return925.89—Unverified
4TD3Average Return198.44—Unverified
5DDPGAverage Return139.14—Unverified
#ModelMetricClaimedVerifiedStatus
1SACAverage Return5,745.27—Unverified
2MEowAverage Return5,526.66—Unverified
3DDPGAverage Return2,994.54—Unverified
4PPOAverage Return2,739.81—Unverified
5TD3Average Return2,612.74—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward5,163.54—Unverified
2AWRMean Reward5,067—Unverified
#ModelMetricClaimedVerifiedStatus
1Orthogonal decision treeAverage Return500—Unverified
2Oblique decision treeAverage Return500—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward9,571.99—Unverified
2AWRMean Reward9,136—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward3,458.22—Unverified
2AWRMean Reward3,405—Unverified
#ModelMetricClaimedVerifiedStatus
1Oblique decision treeAverage Return272.14—Unverified
2AWRAverage Return229—Unverified
#ModelMetricClaimedVerifiedStatus
1Orthogonal decision treeAverage Return-101.72—Unverified
2Oblique decision treeAverage Return-106.02—Unverified
#ModelMetricClaimedVerifiedStatus
1TLA with Hierarchical Reward FunctionsMean Reward-125.02—Unverified
2TLAMean Reward-154.92—Unverified
#ModelMetricClaimedVerifiedStatus
1AWRMean Reward5,813—Unverified
2TLAMean Reward3,878.41—Unverified
#ModelMetricClaimedVerifiedStatus
1AWRAverage Return4,996—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward9,356.67—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward1,000—Unverified
#ModelMetricClaimedVerifiedStatus
1TLAMean Reward93.88—Unverified