SOTAVerified

MuJoCo

Papers

Showing 401–450 of 677 papers

TitleStatusHype
Accelerating Diffusion Models in Offline RL via Reward-Aware Consistency Trajectory Distillation—0
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping—0
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble—0
A Computational Model of Learning Flexible Navigation in a Maze by Layout-Conforming Replay of Place Cells—0
A Computational Theory of Learning Flexible Reward-Seeking Behavior with Place Cells—0
Action Redundancy in Reinforcement Learning—0
Active Learning of Dynamics Using Prior Domain Knowledge in the Sampling Process—0
Active Reinforcement Learning Strategies for Offline Policy Improvement—0
Actor-Director-Critic: A Novel Deep Reinforcement Learning Framework—0
Adapting Double Q-Learning for Continuous Reinforcement Learning—0
Adapting World Models with Latent-State Dynamics Residuals—0
Adaptive Ensemble Q-learning: Minimizing Estimation Bias via Error Feedback—0
Adaptive N-step Bootstrapping with Off-policy Data—0
Adaptive Q-Network: On-the-fly Target Selection for Deep Reinforcement Learning—0
Addressing Distribution Shift in Online Reinforcement Learning with Offline Datasets—0
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning—0
Adventurer: Exploration with BiGAN for Deep Reinforcement Learning—0
Adversarial Imitation Learning via Random Search—0
A Game-Theoretic Perspective of Generalization in Reinforcement Learning—0
A Generalized Training Approach for Multiagent Learning—0
AgentMixer: Multi-Agent Correlated Policy Factorization—0
Aggressive Q-Learning with Ensembles: Achieving Both High Sample Efficiency and High Asymptotic Performance—0
A K-fold Method for Baseline Estimation in Policy Gradient Algorithms—0
Aligning Humans and Robots via Reinforcement Learning from Implicit Human Feedback—0
A Logarithmic Barrier Method For Proximal Policy Optimization—0
ALOHA 2: An Enhanced Low-Cost Hardware for Bimanual Teleoperation—0
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem—0
An Empirical Analysis of Proximal Policy Optimization with Kronecker-factored Natural Gradients—0
Sim2Sim Evaluation of a Novel Data-Efficient Differentiable Physics Engine for Tensegrity Robots—0
An Intelligent Social Learning-based Optimization Strategy for Black-box Robotic Control with Reinforcement Learning—0
A Perspective of Q-value Estimation on Offline-to-Online Reinforcement Learning—0
A Pontryagin Perspective on Reinforcement Learning—0
A Pragmatic Look at Deep Imitation Learning—0
A Recurrent Differentiable Engine for Modeling Tensegrity Robots Trainable with Low-Frequency Data—0
A Reinforcement Learning Based Controller to Minimize Forces on the Crutches of a Lower-Limb Exoskeleton—0
A Review of Nine Physics Engines for Reinforcement Learning Research—0
A Simple Mixture Policy Parameterization for Improving Sample Efficiency of CVaR Optimization—0
A Strategy-Oriented Bayesian Soft Actor-Critic Model—0
Asynchronous Federated Reinforcement Learning with Policy Gradient Updates: Algorithm Design and Convergence Analysis—0
Attraction-Repulsion Actor-Critic for Continuous Control Reinforcement Learning—0
A Unified Bellman Optimality Principle Combining Reward Maximization and Empowerment—0
A Unifying Framework for Causal Imitation Learning with Hidden Confounders—0
AutoDIME: Automatic Design of Interesting Multi-Agent Environments—0
Auto-Encoding Inverse Reinforcement Learning—0
Autoregressive Dynamics Models for Offline Policy Evaluation and Optimization—0
Average-Reward Reinforcement Learning with Trust Region Methods—0
AVG-DICE: Stationary Distribution Correction by Regression—0
Backward Imitation and Forward Reinforcement Learning via Bi-directional Model Rollouts—0
Balancing Constraints and Rewards with Meta-Gradient D4PG—0
Bayesian Distributional Policy Gradients—0
Show:102550
← PrevPage 9 of 14Next →

No leaderboard results yet.