Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1551–1600 of 15113 papers

Title	Date	Tasks	Status	Hype
Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks	Jun 14, 2020	BenchmarkingDeep Reinforcement Learning	CodeCode Available	1
A Deep Reinforced Model for Abstractive Summarization	May 11, 2017	Abstractive Text SummarizationDecoder	CodeCode Available	1
Agents that Listen: High-Throughput Reinforcement Learning with Multiple Sensory Systems	Jul 5, 2021	Game of Doomreinforcement-learning	CodeCode Available	1
Learning with AMIGo: Adversarially Motivated Intrinsic Goals	Jun 22, 2020	Meta-LearningReinforcement Learning (RL)	CodeCode Available	1
Comparing Observation and Action Representations for Deep Reinforcement Learning in μRTS	Oct 26, 2019	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
Automatic Data Augmentation for Generalization in Deep Reinforcement Learning	Jun 23, 2020	Data AugmentationDeep Reinforcement Learning	CodeCode Available	1
Towards Real-World Deployment of Reinforcement Learning for Traffic Signal Control	Mar 30, 2021	CPUOpenAI Gym	CodeCode Available	1
Lenient Multi-Agent Deep Reinforcement Learning	Jul 14, 2017	Deep Reinforcement LearningMulti-agent Reinforcement Learning	CodeCode Available	1
Leveraging Factored Action Spaces for Efficient Offline Reinforcement Learning in Healthcare	May 2, 2023	Offline RLreinforcement-learning	CodeCode Available	1
CommonPower: A Framework for Safe Data-Driven Smart Grid Control	Jun 5, 2024	Benchmarkingenergy management	CodeCode Available	1
Agent with Warm Start and Active Termination for Plane Localization in 3D Ultrasound	Oct 10, 2019	Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
Leveraging Symmetry to Accelerate Learning of Trajectory Tracking Controllers for Free-Flying Robotic Systems	Sep 17, 2024	Reinforcement Learning (RL)	CodeCode Available	1
Agent with Warm Start and Adaptive Dynamic Termination for Plane Localization in 3D Ultrasound	Mar 26, 2021	Deep Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
LibSignal: An Open Library for Traffic Signal Control	Nov 19, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
Lifelong Incremental Reinforcement Learning with Online Bayesian Inference	Jul 28, 2020	Bayesian InferenceClustering	CodeCode Available	1
Lifelong Machine Learning of Functionally Compositional Structures	Jul 25, 2022	BIG-bench Machine LearningContinual Learning	CodeCode Available	1
A2C is a special case of PPO	May 18, 2022	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
A Cooperative Multi-Agent Reinforcement Learning Framework for Resource Balancing in Complex Logistics Network	Mar 2, 2019	Combinatorial OptimizationManagement	CodeCode Available	1
Communicative Reinforcement Learning Agents for Landmark Detection in Brain Images	Aug 18, 2020	Multi-agent Reinforcement Learningreinforcement-learning	CodeCode Available	1
LOA: Logical Optimal Actions for Text-based Interaction Games	Oct 21, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
Logic and the 2-Simplicial Transformer	May 1, 2020	Deep Reinforcement LearningInductive Bias	CodeCode Available	1
Comparing Popular Simulation Environments in the Scope of Robotics and Reinforcement Learning	Mar 8, 2021	CPUreinforcement-learning	CodeCode Available	1
Compound AI Systems Optimization: A Survey of Methods, Challenges, and Future Directions	Jun 9, 2025	Reinforcement Learning (RL)	CodeCode Available	1
Combining Reinforcement Learning with Lin-Kernighan-Helsgaun Algorithm for the Traveling Salesman Problem	Dec 8, 2020	Combinatorial OptimizationQ-Learning	CodeCode Available	1
Low-Rank Modular Reinforcement Learning via Muscle Synergy	Oct 26, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
LS-IQ: Implicit Reward Regularization for Inverse Reinforcement Learning	Mar 1, 2023	Continuous ControlImitation Learning	CodeCode Available	1
Lyapunov Barrier Policy Optimization	Mar 16, 2021	Reinforcement Learning (RL)	CodeCode Available	1
Lyapunov-Regularized Reinforcement Learning for Power System Transient Stability	Mar 5, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
An Equivalence between Loss Functions and Non-Uniform Sampling in Experience Replay	Jul 12, 2020	Deep Reinforcement LearningMuJoCo	CodeCode Available	1
Combining Reinforcement Learning with Model Predictive Control for On-Ramp Merging	Nov 17, 2020	Autonomous DrivingModel Predictive Control	CodeCode Available	1
Combining Modular Skills in Multitask Learning	Feb 28, 2022	Instruction Followingreinforcement-learning	CodeCode Available	1
MADE: Exploration via Maximizing Deviation from Explored Regions	Jun 18, 2021	Efficient ExplorationReinforcement Learning (RL)	CodeCode Available	1
MAMBPO: Sample-efficient multi-robot reinforcement learning using learned world models	Mar 5, 2021	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents	Apr 3, 2023	ManagementReinforcement Learning (RL)	CodeCode Available	1
Abstract-to-Executable Trajectory Translation for One-Shot Task Generalization	Oct 14, 2022	Few-Shot Imitation LearningReinforcement Learning (RL)	CodeCode Available	1
Combining Reinforcement Learning and Constraint Programming for Combinatorial Optimization	Jun 2, 2020	Combinatorial OptimizationDeep Reinforcement Learning	CodeCode Available	1
Market-making with reinforcement-learning (SAC)	Aug 27, 2020	Positionreinforcement-learning	CodeCode Available	1
MARLeME: A Multi-Agent Reinforcement Learning Model Extraction Library	Apr 16, 2020	Model extractionMulti-agent Reinforcement Learning	CodeCode Available	1
Reinforcement Learning for Combining Search Methods in the Calibration of Economic ABMs	Feb 23, 2023	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
MarsExplorer: Exploration of Unknown Terrains via Deep Reinforcement Learning and Procedurally Generated Environments	Jul 21, 2021	Deep Reinforcement LearningOpenAI Gym	CodeCode Available	1
Combinatorial Optimization with Policy Adaptation using Latent Space Search	Nov 13, 2023	BenchmarkingCombinatorial Optimization	CodeCode Available	1
An End-to-End Reinforcement Learning Approach for Job-Shop Scheduling Problems Based on Constraint Programming	Jun 9, 2023	Combinatorial OptimizationFeature Engineering	CodeCode Available	1
Combining Deep Reinforcement Learning and Search for Imperfect-Information Games	Jul 27, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
An End-to-end Deep Reinforcement Learning Approach for the Long-term Short-term Planning on the Frenet Space	Nov 26, 2020	Decision MakingDeep Reinforcement Learning	CodeCode Available	1
Maximum a Posteriori Policy Optimisation	Jun 14, 2018	continuous-controlContinuous Control	CodeCode Available	1
Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning	Jul 6, 2020	Multi-Goal Reinforcement Learningreinforcement-learning	CodeCode Available	1
A Sustainable Ecosystem through Emergent Cooperation in Multi-Agent Reinforcement Learning	Jul 19, 2021	Multi-agent Reinforcement Learningreinforcement-learning	CodeCode Available	1
A SWAT-based Reinforcement Learning Framework for Crop Management	Feb 10, 2023	BenchmarkingDecision Making	CodeCode Available	1
Combinatorial Optimization by Graph Pointer Networks and Hierarchical Reinforcement Learning	Nov 12, 2019	Combinatorial OptimizationGraph Embedding	CodeCode Available	1
Learning to combine primitive skills: A step towards versatile robotic manipulation	Aug 2, 2019	Data AugmentationImitation Learning	CodeCode Available	1

Show:10 25 50

← PrevPage 32 of 303Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified