Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1576–1600 of 15113 papers

Title	Date	Tasks	Status	Hype
LS-IQ: Implicit Reward Regularization for Inverse Reinforcement Learning	Mar 1, 2023	Continuous ControlImitation Learning	CodeCode Available	1
Lyapunov Barrier Policy Optimization	Mar 16, 2021	Reinforcement Learning (RL)	CodeCode Available	1
Lyapunov-Regularized Reinforcement Learning for Power System Transient Stability	Mar 5, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
An Equivalence between Loss Functions and Non-Uniform Sampling in Experience Replay	Jul 12, 2020	Deep Reinforcement LearningMuJoCo	CodeCode Available	1
Combining Reinforcement Learning with Model Predictive Control for On-Ramp Merging	Nov 17, 2020	Autonomous DrivingModel Predictive Control	CodeCode Available	1
Combining Modular Skills in Multitask Learning	Feb 28, 2022	Instruction Followingreinforcement-learning	CodeCode Available	1
MADE: Exploration via Maximizing Deviation from Explored Regions	Jun 18, 2021	Efficient ExplorationReinforcement Learning (RL)	CodeCode Available	1
MAMBPO: Sample-efficient multi-robot reinforcement learning using learned world models	Mar 5, 2021	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents	Apr 3, 2023	ManagementReinforcement Learning (RL)	CodeCode Available	1
Abstract-to-Executable Trajectory Translation for One-Shot Task Generalization	Oct 14, 2022	Few-Shot Imitation LearningReinforcement Learning (RL)	CodeCode Available	1
Combining Reinforcement Learning and Constraint Programming for Combinatorial Optimization	Jun 2, 2020	Combinatorial OptimizationDeep Reinforcement Learning	CodeCode Available	1
Market-making with reinforcement-learning (SAC)	Aug 27, 2020	Positionreinforcement-learning	CodeCode Available	1
MARLeME: A Multi-Agent Reinforcement Learning Model Extraction Library	Apr 16, 2020	Model extractionMulti-agent Reinforcement Learning	CodeCode Available	1
Reinforcement Learning for Combining Search Methods in the Calibration of Economic ABMs	Feb 23, 2023	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
MarsExplorer: Exploration of Unknown Terrains via Deep Reinforcement Learning and Procedurally Generated Environments	Jul 21, 2021	Deep Reinforcement LearningOpenAI Gym	CodeCode Available	1
Combinatorial Optimization with Policy Adaptation using Latent Space Search	Nov 13, 2023	BenchmarkingCombinatorial Optimization	CodeCode Available	1
An End-to-End Reinforcement Learning Approach for Job-Shop Scheduling Problems Based on Constraint Programming	Jun 9, 2023	Combinatorial OptimizationFeature Engineering	CodeCode Available	1
Combining Deep Reinforcement Learning and Search for Imperfect-Information Games	Jul 27, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
An End-to-end Deep Reinforcement Learning Approach for the Long-term Short-term Planning on the Frenet Space	Nov 26, 2020	Decision MakingDeep Reinforcement Learning	CodeCode Available	1
Maximum a Posteriori Policy Optimisation	Jun 14, 2018	continuous-controlContinuous Control	CodeCode Available	1
Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning	Jul 6, 2020	Multi-Goal Reinforcement Learningreinforcement-learning	CodeCode Available	1
A Sustainable Ecosystem through Emergent Cooperation in Multi-Agent Reinforcement Learning	Jul 19, 2021	Multi-agent Reinforcement Learningreinforcement-learning	CodeCode Available	1
A SWAT-based Reinforcement Learning Framework for Crop Management	Feb 10, 2023	BenchmarkingDecision Making	CodeCode Available	1
Combinatorial Optimization by Graph Pointer Networks and Hierarchical Reinforcement Learning	Nov 12, 2019	Combinatorial OptimizationGraph Embedding	CodeCode Available	1
Learning to combine primitive skills: A step towards versatile robotic manipulation	Aug 2, 2019	Data AugmentationImitation Learning	CodeCode Available	1

Show:10 25 50

← PrevPage 64 of 605Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified