Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1901–1950 of 15113 papers

Title	Date	Tasks	Status	Hype
RLx2: Training a Sparse Deep Reinforcement Learning Model from Scratch	May 30, 2022	Continuous ControlDeep Reinforcement Learning	CodeCode Available	1
R-MADDPG for Partially Observable Environments and Limited Communication	Feb 16, 2020	reinforcement-learningReinforcement Learning	CodeCode Available	1
Robot Navigation in a Crowd by Integrating Deep Reinforcement Learning and Online Planning	Feb 26, 2021	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
Robot Navigation in Constrained Pedestrian Environments using Reinforcement Learning	Oct 16, 2020	Pose Estimationreinforcement-learning	CodeCode Available	1
Robust Adversarial Reinforcement Learning	Mar 8, 2017	Frictionreinforcement-learning	CodeCode Available	1
Robust Deep Reinforcement Learning against Adversarial Perturbations on State Observations	Mar 19, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
Robust Deep Reinforcement Learning through Bootstrapped Opportunistic Curriculum	Jun 21, 2022	Adversarial RobustnessDeep Reinforcement Learning	CodeCode Available	1
Reinforcement Learning for Combining Search Methods in the Calibration of Economic ABMs	Feb 23, 2023	reinforcement-learningReinforcement Learning (RL)	CodeCode Available	1
Robust Knowledge Adaptation for Dynamic Graph Neural Networks	Jul 22, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
A Workflow for Offline Model-Free Robotic Reinforcement Learning	Sep 22, 2021	Offline RLreinforcement-learning	CodeCode Available	1
Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks	Jun 14, 2020	BenchmarkingDeep Reinforcement Learning	CodeCode Available	1
Learning to combine primitive skills: A step towards versatile robotic manipulation	Aug 2, 2019	Data AugmentationImitation Learning	CodeCode Available	1
BabyAI 1.1	Jul 24, 2020	Computational EfficiencyImitation Learning	CodeCode Available	1
Zero-Shot Compositional Policy Learning via Language Grounding	Apr 15, 2020	DescriptiveDomain Adaptation	CodeCode Available	1
Robust Value Iteration for Continuous Control Tasks	May 25, 2021	continuous-controlContinuous Control	CodeCode Available	1
ROI-Constrained Bidding via Curriculum-Guided Bayesian Reinforcement Learning	Jun 10, 2022	reinforcement-learningReinforcement Learning	CodeCode Available	1
A Modular Framework for Reinforcement Learning Optimal Execution	Aug 11, 2022	Algorithmic Tradingreinforcement-learning	CodeCode Available	1
MRHER: Model-based Relay Hindsight Experience Replay for Sequential Object Manipulation Tasks with Sparse Rewards	Jun 28, 2023	FetchPush-v1Multi-Goal Reinforcement Learning	CodeCode Available	1
Addressing Function Approximation Error in Actor-Critic Methods	Feb 26, 2018	Continuous ControlOpenAI Gym	CodeCode Available	1
Bridging RL Theory and Practice with the Effective Horizon	Apr 19, 2023	Deep Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
safe-control-gym: a Unified Benchmark Suite for Safe Learning-based Control and Reinforcement Learning in Robotics	Sep 13, 2021	reinforcement-learningReinforcement Learning	CodeCode Available	1
Safe Deep Policy Adaptation	Oct 8, 2023	reinforcement-learningReinforcement Learning	CodeCode Available	1
Safe Driving via Expert Guided Policy Optimization	Oct 13, 2021	Offline RLreinforcement-learning	CodeCode Available	1
Safe Exploration in Continuous Action Spaces	Jan 26, 2018	Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
Combining Modular Skills in Multitask Learning	Feb 28, 2022	Instruction Followingreinforcement-learning	CodeCode Available	1
Backprop-Free Reinforcement Learning with Active Neural Generative Coding	Jul 10, 2021	Q-Learningreinforcement-learning	CodeCode Available	1
Combinatorial Optimization with Policy Adaptation using Latent Space Search	Nov 13, 2023	BenchmarkingCombinatorial Optimization	CodeCode Available	1
Bridging the Gap Between f-GANs and Wasserstein GANs	Jan 1, 2020	Density Ratio EstimationImage Generation	CodeCode Available	1
Safe Navigation: Training Autonomous Vehicles using Deep Reinforcement Learning in CARLA	Oct 23, 2023	Autonomous VehiclesDeep Reinforcement Learning	CodeCode Available	1
Safe Offline Reinforcement Learning with Real-Time Budget Constraints	Jun 1, 2023	reinforcement-learningReinforcement Learning	CodeCode Available	1
Adaptive Risk-Tendency: Nano Drone Navigation in Cluttered Environments with Distributional Reinforcement Learning	Mar 28, 2022	Distributional Reinforcement LearningDrone navigation	CodeCode Available	1
Safe Reinforcement Learning in Constrained Markov Decision Processes	Aug 15, 2020	reinforcement-learningReinforcement Learning	CodeCode Available	1
Bridging State and History Representations: Understanding Self-Predictive RL	Jan 17, 2024	Deep Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
Safe Reinforcement Learning via Curriculum Induction	Jun 22, 2020	Autonomous Drivingreinforcement-learning	CodeCode Available	1
SAMBA: Safe Model-Based & Active Reinforcement Learning	Jun 12, 2020	modelReinforcement Learning	CodeCode Available	1
Same State, Different Task: Continual Reinforcement Learning without Interference	Jun 5, 2021	Continual Learningreinforcement-learning	CodeCode Available	1
Sample-Efficient Automated Deep Reinforcement Learning	Sep 3, 2020	Deep Reinforcement LearningHyperparameter Optimization	CodeCode Available	1
Sample-efficient Cross-Entropy Method for Real-time Planning	Aug 14, 2020	Model-based Reinforcement Learningreinforcement-learning	CodeCode Available	1
Sample-efficient Model-based Reinforcement Learning for Quantum Control	Apr 19, 2023	Inductive BiasModel-based Reinforcement Learning	CodeCode Available	1
Sample Efficient Reinforcement Learning through Learning from Demonstrations in Minecraft	Mar 12, 2020	Deep Reinforcement LearningMinecraft	CodeCode Available	1
Sample Efficient Reinforcement Learning via Model-Ensemble Exploration and Exploitation	Jul 5, 2021	continuous-controlContinuous Control	CodeCode Available	1
Combinatorial Optimization by Graph Pointer Networks and Hierarchical Reinforcement Learning	Nov 12, 2019	Combinatorial OptimizationGraph Embedding	CodeCode Available	1
SARL*: Deep Reinforcement Learning based Human-Aware Navigation for Mobile Robot in Indoor Environments	Jan 20, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
SATORI-R1: Incentivizing Multimodal Reasoning with Spatial Grounding and Verifiable Rewards	May 25, 2025	Image CaptioningMultimodal Reasoning	CodeCode Available	1
Scalable Bayesian Inverse Reinforcement Learning	Feb 12, 2021	Bayesian InferenceImitation Learning	CodeCode Available	1
Scalable Multi-Agent Model-Based Reinforcement Learning	May 25, 2022	Mambamodel	CodeCode Available	1
A multi-agent reinforcement learning model of common-pool resource appropriation	Jul 20, 2017	Deep Reinforcement LearningMulti-agent Reinforcement Learning	CodeCode Available	1
Scalable Planning and Learning for Multiagent POMDPs: Extended Version	Apr 4, 2014	reinforcement-learningReinforcement Learning	CodeCode Available	1
Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation	Aug 17, 2017	Atari Gamescontinuous-control	CodeCode Available	1
Combining Deep Reinforcement Learning and Search for Imperfect-Information Games	Jul 27, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1

Show:10 25 50

← PrevPage 39 of 303Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified