Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1926–1950 of 15113 papers

Title	Date	Tasks	Status	Hype
Backprop-Free Reinforcement Learning with Active Neural Generative Coding	Jul 10, 2021	Q-Learningreinforcement-learning	CodeCode Available	1
Combinatorial Optimization with Policy Adaptation using Latent Space Search	Nov 13, 2023	BenchmarkingCombinatorial Optimization	CodeCode Available	1
Bridging the Gap Between f-GANs and Wasserstein GANs	Jan 1, 2020	Density Ratio EstimationImage Generation	CodeCode Available	1
Safe Navigation: Training Autonomous Vehicles using Deep Reinforcement Learning in CARLA	Oct 23, 2023	Autonomous VehiclesDeep Reinforcement Learning	CodeCode Available	1
Safe Offline Reinforcement Learning with Real-Time Budget Constraints	Jun 1, 2023	reinforcement-learningReinforcement Learning	CodeCode Available	1
Adaptive Risk-Tendency: Nano Drone Navigation in Cluttered Environments with Distributional Reinforcement Learning	Mar 28, 2022	Distributional Reinforcement LearningDrone navigation	CodeCode Available	1
Safe Reinforcement Learning in Constrained Markov Decision Processes	Aug 15, 2020	reinforcement-learningReinforcement Learning	CodeCode Available	1
Bridging State and History Representations: Understanding Self-Predictive RL	Jan 17, 2024	Deep Reinforcement LearningReinforcement Learning (RL)	CodeCode Available	1
Safe Reinforcement Learning via Curriculum Induction	Jun 22, 2020	Autonomous Drivingreinforcement-learning	CodeCode Available	1
SAMBA: Safe Model-Based & Active Reinforcement Learning	Jun 12, 2020	modelReinforcement Learning	CodeCode Available	1
Same State, Different Task: Continual Reinforcement Learning without Interference	Jun 5, 2021	Continual Learningreinforcement-learning	CodeCode Available	1
Sample-Efficient Automated Deep Reinforcement Learning	Sep 3, 2020	Deep Reinforcement LearningHyperparameter Optimization	CodeCode Available	1
Sample-efficient Cross-Entropy Method for Real-time Planning	Aug 14, 2020	Model-based Reinforcement Learningreinforcement-learning	CodeCode Available	1
Sample-efficient Model-based Reinforcement Learning for Quantum Control	Apr 19, 2023	Inductive BiasModel-based Reinforcement Learning	CodeCode Available	1
Sample Efficient Reinforcement Learning through Learning from Demonstrations in Minecraft	Mar 12, 2020	Deep Reinforcement LearningMinecraft	CodeCode Available	1
Sample Efficient Reinforcement Learning via Model-Ensemble Exploration and Exploitation	Jul 5, 2021	continuous-controlContinuous Control	CodeCode Available	1
Combinatorial Optimization by Graph Pointer Networks and Hierarchical Reinforcement Learning	Nov 12, 2019	Combinatorial OptimizationGraph Embedding	CodeCode Available	1
SARL*: Deep Reinforcement Learning based Human-Aware Navigation for Mobile Robot in Indoor Environments	Jan 20, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1
SATORI-R1: Incentivizing Multimodal Reasoning with Spatial Grounding and Verifiable Rewards	May 25, 2025	Image CaptioningMultimodal Reasoning	CodeCode Available	1
Scalable Bayesian Inverse Reinforcement Learning	Feb 12, 2021	Bayesian InferenceImitation Learning	CodeCode Available	1
Scalable Multi-Agent Model-Based Reinforcement Learning	May 25, 2022	Mambamodel	CodeCode Available	1
A multi-agent reinforcement learning model of common-pool resource appropriation	Jul 20, 2017	Deep Reinforcement LearningMulti-agent Reinforcement Learning	CodeCode Available	1
Scalable Planning and Learning for Multiagent POMDPs: Extended Version	Apr 4, 2014	reinforcement-learningReinforcement Learning	CodeCode Available	1
Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation	Aug 17, 2017	Atari Gamescontinuous-control	CodeCode Available	1
Combining Deep Reinforcement Learning and Search for Imperfect-Information Games	Jul 27, 2020	Deep Reinforcement Learningreinforcement-learning	CodeCode Available	1

Show:10 25 50

← PrevPage 78 of 605Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified