SOTAVerified

MuJoCo

Papers

Showing 451–500 of 677 papers

TitleStatusHype
Diverse Imitation Learning via Self-OrganizingGenerative Models—0
Evaluating Robustness of Cooperative MARL—0
Fight fire with fire: countering bad shortcuts in imitation learning with good shortcuts—0
Hypothesis Driven Coordinate Ascent for Reinforcement Learning—0
Maximizing Ensemble Diversity in Deep Reinforcement Learning—0
OVD-Explorer: A General Information-theoretic Exploration Approach for Reinforcement Learning—0
SPP-RL: State Planning Policy Reinforcement Learning—0
Efficiently Training On-Policy Actor-Critic Networks in Robotic Deep Reinforcement Learning with Demonstration-like Sampled Exploration—0
Improved Soft Actor-Critic: Mixing Prioritized Off-Policy Samples with On-Policy Experience—0
Parameter-free Reduction of the Estimation Bias in Deep Reinforcement Learning for Deterministic Policy GradientsCode0
Membership Inference Attacks Against Temporally Correlated Data in Deep Reinforcement Learning—0
Hindsight Reward Tweaking via Conditional Deep Reinforcement Learning—0
Improved Robustness and Safety for Pre-Adaptation of Meta Reinforcement Learning with Prior Regularization—0
A general class of surrogate functions for stable and efficient reinforcement learningCode0
A Pragmatic Look at Deep Imitation Learning—0
Understanding Adversarial Attacks on Observations in Deep Reinforcement LearningCode0
On the Benefits of Inducing Local Lipschitzness for Robust Generative Adversarial Imitation Learning—0
SparseDice: Imitation Learning for Temporally Sparse Data via Regularization—0
Keyframe-Focused Visual Imitation Learning—0
Average-Reward Reinforcement Learning with Trust Region Methods—0
SoftDICE for Imitation Learning: Rethinking Off-policy Distribution Matching—0
DisTop: Discovering a Topological representation to learn diverse and rewarding skills—0
Regret Minimization Experience Replay in Off-Policy Reinforcement LearningCode0
Estimating Disentangled Belief about Hidden State and Hidden Task for Meta-RL—0
Context-Based Soft Actor Critic for Environments with Non-stationary DynamicsCode0
Autoregressive Dynamics Models for Offline Policy Evaluation and Optimization—0
Reinforcement Learning using Guided Observability—0
Probabilistic Mixture-of-Experts for Efficient Deep Reinforcement LearningCode0
Reward function shape exploration in adversarial imitation learning: an empirical study—0
Learning What To Do by Simulating the PastCode0
No Need for Interactions: Robust Model-Based Imitation Learning using Neural ODECode0
Hamiltonian Policy Optimization in Reinforcement Learning—0
Improving Actor-Critic Reinforcement Learning via Hamiltonian Monte Carlo Method—0
Bayesian Distributional Policy Gradients—0
A Quadratic Actor Network for Model-Free Reinforcement LearningCode0
Improving Context-Based Meta-Reinforcement Learning with Self-Supervised Trajectory Contrastive Learning—0
Hamiltonian Policy Optimization—0
Action Redundancy in Reinforcement Learning—0
On Proximal Policy Optimization's Heavy-tailed Gradients—0
Model-Invariant State Abstractions for Model-Based Reinforcement Learning—0
CKNet: A Convolutional Neural Network Based on Koopman Operator for Modeling Latent Dynamics from Pixels—0
Q-Value Weighted Regression: Reinforcement Learning with Limited DataCode0
Robust Policy Gradient against Strong Data CorruptionCode0
Variance Penalized On-Policy and Off-Policy Actor-CriticCode0
GST: Group-Sparse Training for Accelerating Deep Reinforcement Learning—0
Hellinger Distance Constrained Regression—0
Addressing Distribution Shift in Online Reinforcement Learning with Offline Datasets—0
Self-Supervised Continuous Control without Policy Gradient—0
MQES: Max-Q Entropy Search for Efficient Exploration in Continuous Reinforcement Learning—0
Formal Language Constrained Markov Decision Processes—0
Show:102550
← PrevPage 10 of 14Next →

No leaderboard results yet.