SOTAVerified

Policy Gradient Methods

Papers

Showing 176–200 of 382 papers

TitleStatusHype
PGPS : Coupling Policy Gradient with Population-based Search—0
PG-Rainbow: Using Distributional Reinforcement Learning in Policy Gradient Methods—0
Policy Gradient for Coherent Risk Measures—0
Policy Gradient for Rectangular Robust Markov Decision Processes—0
Policy gradient learning methods for stochastic control with exit time and applications to share repurchase pricing—0
Policy Gradient Methods Find the Nash Equilibrium in N-player General-sum Linear-quadratic Games—0
Policy Gradient Methods for Designing Dynamic Output Feedback Controllers—0
Policy Gradient Methods for Discrete Time Linear Quadratic Regulator With Random Parameters—0
Policy Gradient Methods for Off-policy Control—0
Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines—0
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence—0
Policy Gradient Methods for the Noisy Linear Quadratic Regulator over a Finite Horizon—0
Policy Gradient Optimization of Thompson Sampling Policies—0
Policy Gradients for Contextual Recommendations—0
Policy Learning and Evaluation with Randomized Quasi-Monte Carlo—0
Policy Mirror Descent Inherently Explores Action Space—0
Policy Optimization by Genetic Distillation—0
Policy Optimization for Markovian Jump Linear Quadratic Control: Gradient-Based Methods and Global Convergence—0
Policy Optimization for H_2 Linear Control with H_ Robustness Guarantee: Implicit Regularization and Global Convergence—0
Policy Optimization with Demonstrations—0
Policy Optimization with Stochastic Mirror Descent—0
Policy Search by Target Distribution Learning for Continuous Control—0
Policy Search for Motor Primitives in Robotics—0
Policy Testing in Markov Decision Processes—0
Policy Tree Network—0
Show:102550
← PrevPage 8 of 16Next →

No leaderboard results yet.