Reinforcement Learning (RL)

Reinforcement Learning (RL) involves training an agent to take actions in an environment to maximize a cumulative reward signal. The agent interacts with the environment and learns by receiving feedback in the form of rewards or punishments for its actions. The goal of reinforcement learning is to find the optimal policy or decision-making strategy that maximizes the long-term reward.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 771–780 of 15113 papers

Title	Date	Tasks	Status	Hype
SySLLM: Generating Synthesized Policy Summaries for Reinforcement Learning Agents Using Large Language Models	Mar 13, 2025	Reinforcement Learning (RL)World Knowledge	—Unverified	0
H2-MARL: Multi-Agent Reinforcement Learning for Pareto Optimality in Hospital Capacity Strain and Human Mobility during Epidemic	Mar 13, 2025	Multi-agent Reinforcement LearningReinforcement Learning (RL)	—Unverified	0
Safe Continual Domain Adaptation after Sim2Real Transfer of Reinforcement Learning Policies in Robotics	Mar 13, 2025	Continual LearningDomain Adaptation	—Unverified	0
SortingEnv: An Extendable RL-Environment for an Industrial Sorting Process	Mar 13, 2025	Reinforcement Learning (RL)	—Unverified	0
NIL: No-data Imitation Learning by Leveraging Pre-trained Video Diffusion Models	Mar 13, 2025	Imitation LearningReinforcement Learning (RL)	—Unverified	0
DeepSeek-Inspired Exploration of RL-based LLMs and Synergy with Wireless Networks: A Survey	Mar 13, 2025	Edge-computingIntelligent Communication	—Unverified	0
Solving Bayesian inverse problems with diffusion priors and off-policy RL	Mar 12, 2025	Reinforcement Learning (RL)	—Unverified	0
Edge AI-Powered Real-Time Decision-Making for Autonomous Vehicles in Adverse Weather Conditions	Mar 12, 2025	Autonomous NavigationAutonomous Vehicles	—Unverified	0
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning	Mar 12, 2025	Question AnsweringRAG	CodeCode Available	7
Optimisation of the Accelerator Control by Reinforcement Learning: A Simulation-Based Approach	Mar 12, 2025	Reinforcement Learning (RL)	—Unverified	0

Show:10 25 50

← PrevPage 78 of 1512Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	PPG	Mean Normalized Performance	0.76	—	Unverified
2	PPO	Mean Normalized Performance	0.58	—	Unverified