Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1401–1450 of 15113 papers

Title	Date	Tasks	Status	Hype
Goal-Aware Cross-Entropy for Multi-Target Reinforcement Learning	Oct 25, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
Goal-Conditioned Generators of Deep Policies	Jul 4, 2022	continuous-controlContinuous Control	CodeCode Available	1
Compound AI Systems Optimization: A Survey of Methods, Challenges, and Future Directions	Jun 9, 2025	Reinforcement Learning (RL)	CodeCode Available	1
"Good Robot!": Efficient Reinforcement Learning for Multi-Step Visual Tasks with Sim to Real Transfer	Sep 25, 2019	reinforcement-learningReinforcement Learning	CodeCode Available	1
Concise Reasoning via Reinforcement Learning	Apr 7, 2025	reinforcement-learningReinforcement Learning	CodeCode Available	1
Compositional Reinforcement Learning from Logical Specifications	Jun 25, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
A Deep Reinforcement Learning Approach for Solving the Traveling Salesman Problem with Drone	Dec 22, 2021	Combinatorial OptimizationComputational Efficiency	CodeCode Available	1
Graph Neural Networks and Reinforcement Learning for Behavior Generation in Semantic Environments	Jun 22, 2020	reinforcement-learningReinforcement Learning	CodeCode Available	1
CompoSuite: A Compositional Reinforcement Learning Benchmark	Jul 8, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
Conditional Mutual Information for Disentangled Representations in Reinforcement Learning	May 23, 2023	continuous-controlContinuous Control	CodeCode Available	1
Comparing Popular Simulation Environments in the Scope of Robotics and Reinforcement Learning	Mar 8, 2021	CPUreinforcement-learning	CodeCode Available	1
Grounding Hindsight Instructions in Multi-Goal Reinforcement Learning for Robotics	Apr 8, 2022	Multi-Goal Reinforcement Learningreinforcement-learning	CodeCode Available	1
Comparing Observation and Action Representations for Deep Reinforcement Learning in μRTS	Oct 26, 2019	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
Competitiveness of MAP-Elites against Proximal Policy Optimization on locomotion tasks in deterministic simulations	Sep 17, 2020	Evolutionary AlgorithmsReinforcement Learning (RL)	CodeCode Available	1
Communicative Reinforcement Learning Agents for Landmark Detection in Brain Images	Aug 18, 2020	Multi-agent Reinforcement Learningreinforcement-learning	CodeCode Available	1
Guiding Online Reinforcement Learning with Action-Free Offline Pretraining	Jan 30, 2023	Offline RLreinforcement-learning	CodeCode Available	1
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents	May 21, 2025	Answer GenerationReinforcement Learning (RL)	CodeCode Available	1
Gym-ANM: Reinforcement Learning Environments for Active Network Management Tasks in Electricity Distribution Systems	Mar 14, 2021	ManagementModel Predictive Control	CodeCode Available	1
Actor-Attention-Critic for Multi-Agent Reinforcement Learning	Oct 5, 2018	Multi-agent Reinforcement Learningreinforcement-learning	CodeCode Available	1
CommonPower: A Framework for Safe Data-Driven Smart Grid Control	Jun 5, 2024	Benchmarkingenergy management	CodeCode Available	1
Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks	Jun 14, 2020	BenchmarkingDeep Reinforcement Learning	CodeCode Available	1
Harnessing Discrete Representations For Continual Reinforcement Learning	Dec 2, 2023	reinforcement-learningReinforcement Learning	CodeCode Available	1
Compiler Optimization for Quantum Computing Using Reinforcement Learning	Dec 8, 2022	Compiler Optimizationreinforcement-learning	CodeCode Available	1
Option-Aware Adversarial Inverse Reinforcement Learning for Robotic Control	Oct 5, 2022	Imitation LearningMulti-Task Learning	CodeCode Available	1
ARLBench: Flexible and Efficient Benchmarking for Hyperparameter Optimization in Reinforcement Learning	Sep 27, 2024	AutoMLBenchmarking	CodeCode Available	1
ARLO: A Framework for Automated Reinforcement Learning	May 20, 2022	feature selectionMuJoCo	CodeCode Available	1
Combining Reinforcement Learning with Model Predictive Control for On-Ramp Merging	Nov 17, 2020	Autonomous DrivingModel Predictive Control	CodeCode Available	1
Hierarchical Learning-based Graph Partition for Large-scale Vehicle Routing Problems	Feb 12, 2025	Reinforcement Learning (RL)	CodeCode Available	1
Hierarchical Reinforcement Learning for Power Network Topology Control	Nov 3, 2023	AllHierarchical Reinforcement Learning	CodeCode Available	1
Hierarchical Reinforcement Learning with Timed Subgoals	Dec 6, 2021	Hierarchical Reinforcement Learningreinforcement-learning	CodeCode Available	1
Combining Reinforcement Learning with Lin-Kernighan-Helsgaun Algorithm for the Traveling Salesman Problem	Dec 8, 2020	Combinatorial OptimizationQ-Learning	CodeCode Available	1
Reinforcement Learning for Combining Search Methods in the Calibration of Economic ABMs	Feb 23, 2023	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning	Jul 5, 2024	reinforcement-learningReinforcement Learning	CodeCode Available	1
HIQL: Offline Goal-Conditioned RL with Latent States as Actions	Jul 22, 2023	Reinforcement Learning (RL)Unsupervised Pre-training	CodeCode Available	1
Combining Modular Skills in Multitask Learning	Feb 28, 2022	Instruction Followingreinforcement-learning	CodeCode Available	1
Learning to combine primitive skills: A step towards versatile robotic manipulation	Aug 2, 2019	Data AugmentationImitation Learning	CodeCode Available	1
How Consistent are Clinicians? Evaluating the Predictability of Sepsis Disease Progression with Dynamics Models	Apr 10, 2024	DiversityReinforcement Learning (RL)	CodeCode Available	1
How Far I'll Go: Offline Goal-Conditioned Reinforcement Learning via f-Advantage Regression	Jun 7, 2022	regressionreinforcement-learning	CodeCode Available	1
Combining Reinforcement Learning and Constraint Programming for Combinatorial Optimization	Jun 2, 2020	Combinatorial OptimizationDeep Reinforcement Learning	CodeCode Available	1
Combining Semantic Guidance and Deep Reinforcement Learning For Generating Human Level Paintings	Nov 25, 2020	Deep Reinforcement LearningModel-based Reinforcement Learning	CodeCode Available	1
Compile Scene Graphs with Reinforcement Learning	Apr 18, 2025	reinforcement-learningReinforcement Learning	CodeCode Available	1
Hybrid intelligence for dynamic job-shop scheduling with deep reinforcement learning and attention mechanism	Jan 3, 2022	Deep Reinforcement LearningGraph Representation Learning	CodeCode Available	1
HYDRA: A Hyper Agent for Dynamic Compositional Visual Reasoning	Mar 19, 2024	Reinforcement Learning (RL)Visual Grounding	CodeCode Available	1
HyperDQN: A Randomized Exploration Method for Deep Reinforcement Learning	Sep 29, 2021	Deep Reinforcement LearningEfficient Exploration	CodeCode Available	1
A Scalable and Reproducible System-on-Chip Simulation for Reinforcement Learning	Apr 27, 2021	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
Hypernetworks in Meta-Reinforcement Learning	Oct 20, 2022	Meta Reinforcement Learningreinforcement-learning	CodeCode Available	1
Scalable Multi-agent Reinforcement Learning Algorithm for Wireless Networks	Aug 1, 2021	Decision MakingMulti-agent Reinforcement Learning	CodeCode Available	1
IGLU Gridworld: Simple and Fast Environment for Embodied Dialog Agents	May 31, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
Conservative and Adaptive Penalty for Model-Based Safe Reinforcement Learning	Dec 14, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
Collective eXplainable AI: Explaining Cooperative Strategies and Agent Contribution in Multiagent Reinforcement Learning with Shapley Values	Oct 4, 2021	Decision MakingDeep Reinforcement Learning	CodeCode Available	1

Show:10 25 50

← PrevPage 29 of 303Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified