SOTAVerified

MuJoCo

Papers

Showing 401–450 of 677 papers

TitleStatusHype
Live in the Moment: Learning Dynamics Model Adapted to Evolving PolicyCode0
Resolving Copycat Problems in Visual Imitation Learning via Residual Action Prediction—0
Feasible Adversarial Robust Reinforcement Learning for Underspecified Environments—0
Prompting Decision Transformer for Few-Shot Policy Generalization—0
CGAR: Critic Guided Action Redistribution in Reinforcement LeaningCode0
Fighting Fire with Fire: Avoiding DNN Shortcuts through Priming—0
Beyond Rewards: a Hierarchical Perspective on Offline Multiagent Behavioral Analysis—0
Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning—0
Relative Policy-Transition Optimization for Fast Policy Transfer—0
Dealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policies—0
Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning—0
Transferable Reward Learning by Dynamics-Agnostic Discriminator Ensemble—0
Multi-Object Grasping in the Plane—0
TaSIL: Taylor Series Imitation LearningCode0
Efficient Reward Poisoning Attacks on Online Deep Reinforcement LearningCode0
SEREN: Knowing When to Explore and When to Exploit—0
Data Valuation for Offline Reinforcement Learning—0
Imitation Learning from Observations under Transition Model DisparityCode0
A Computational Theory of Learning Flexible Reward-Seeking Behavior with Place Cells—0
Continuously Discovering Novel Strategies via Reward-Switching Policy Optimization—0
Hierarchical Reinforcement Learning of Locomotion Policies in Response to Approaching Objects: A Preliminary Study—0
Safe adaptation in multiagent competition—0
Context is Everything: Implicit Identification for Dynamics Adaptation—0
AutoDIME: Automatic Design of Interesting Multi-Agent Environments—0
A Recurrent Differentiable Engine for Modeling Tensegrity Robots Trainable with Low-Frequency Data—0
User-Oriented Robust Reinforcement Learning—0
DNS: Determinantal Point Process Based Neural Network Sampler for Ensemble Reinforcement LearningCode0
STOPS: Short-Term-based Volatility-controlled Policy Search and its Global Convergence—0
Recursive Least Squares Advantage Actor-Critic Algorithms—0
Comparing Model-free and Model-based Algorithms for Offline Reinforcement Learning—0
Self Reward Design with Fine-grained InterpretabilityCode0
Multiagent Model-based Credit Assignment for Continuous Control—0
CEM-GD: Cross-Entropy Method with Gradient Descent Planner for Model-Based Reinforcement LearningCode0
Continuous Control With Ensemble Deep Deterministic Policy GradientsCode0
Uncertainty-aware Low-Rank Q-Matrix Estimation for Deep Reinforcement Learning—0
Aggressive Q-Learning with Ensembles: Achieving Both High Sample Efficiency and High Asymptotic Performance—0
Improving Learning from Demonstrations by Learning from Experience—0
GRI: General Reinforced Imitation and its Application to Vision-Based Autonomous Driving—0
V-MAO: Generative Modeling for Multi-Arm Manipulation of Articulated Objects—0
Time Discretization-Invariant Safe Action Repetition for Policy Gradient MethodsCode0
Smooth Imitation Learning via Smooth Costs and Smooth Policies—0
Policy Search using Dynamic Mirror Descent MPC for Model Free Off Policy RL—0
CIM-PPO:Proximal Policy Optimization with Liu-Correntropy Induced Metric—0
Balancing Value Underestimation and Overestimation with Realistic Actor-CriticCode0
On-Policy Model Errors in Reinforcement Learning—0
Wasserstein Unsupervised Reinforcement Learning—0
Theoretically Principled Deep RL Acceleration via Nearest Neighbor Function Approximation—0
Generalized Maximum Entropy Reinforcement Learning via Reward Shaping—0
Auto-Encoding Inverse Reinforcement Learning—0
Distributional Decision Transformer for Hindsight Information Matching—0
Show:102550
← PrevPage 9 of 14Next →

No leaderboard results yet.