SOTAVerified

Model-based Reinforcement Learning

Papers

Showing 1–25 of 708 papers

TitleStatusHype
TransDreamerV3: Implanting Transformer In DreamerV3Code0
On Quantum BSDE Solver for High-Dimensional Parabolic PDEs—0
Relative Entropy Regularized Reinforcement Learning for Efficient Encrypted Policy Synthesis—0
Accelerating Model-Based Reinforcement Learning using Non-Linear Trajectory Optimization—0
Bregman Centroid Guided Cross-Entropy Method—0
World Models for Cognitive Agents: Transforming Edge Intelligence in Future Networks—0
Calibrated Value-Aware Model Learning with Stochastic Environment Models—0
MedDreamer: Model-Based Reinforcement Learning with Latent Imagination on Complex EHRs for Clinical Decision Support—0
Deep Active Inference Agents for Delayed and Long-Horizon EnvironmentsCode0
JEDI: Latent End-to-end Diffusion Mitigates Agent-Human Performance Asymmetry in Model-Based Reinforcement Learning—0
Gaze Into the Abyss -- Planning to Seek Entropy When Reward is Scarce—0
Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)—0
Improving planning and MBRL with temporally-extended actions—0
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning—0
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning—0
Multi-Goal Dexterous Hand Manipulation using Probabilistic Model-based Reinforcement Learning—0
Data-Assimilated Model-Based Reinforcement Learning for Partially Observed Chaotic Flows—0
PIN-WM: Learning Physics-INformed World Models for Non-Prehensile Manipulation—0
Learning global control of underactuated systems with Model-Based Reinforcement Learning—0
Probabilistic Pontryagin's Maximum Principle for Continuous-Time Model-Based Reinforcement LearningCode0
Learning with Imperfect Models: When Multi-step Prediction Mitigates Compounding Error—0
Probabilistically safe and efficient model-based Reinforcement LearningCode1
Perspective-Shifted Neuro-Symbolic World Models: A Framework for Socially-Aware Robot NavigationCode0
Look Before Leap: Look-Ahead Planning with Uncertainty in Reinforcement Learning—0
Continual Reinforcement Learning for HVAC Systems Control: Integrating Hypernetworks and Transfer LearningCode0
Show:102550
← PrevPage 1 of 29Next →

No leaderboard results yet.