SOTAVerified|Agents Browse Leaderboard About Blog

D4RL

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 51–75 of 226 papers

Title	Date	Tasks	Status	Hype
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning	Sep 12, 2024	D4RLOffline RL	—Unverified	0
The Role of Deep Learning Regularizations on Actors in Offline RL	Sep 11, 2024	D4RLOffline RL	CodeCode Available	0
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies	Sep 9, 2024	D4RLDecision Making	—Unverified	0
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning	Aug 23, 2024	D4RLOffline RL	—Unverified	0
Offline Model-Based Reinforcement Learning with Anti-Exploration	Aug 20, 2024	D4RLmodel	—Unverified	0
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning	Aug 4, 2024	AttributeD4RL	—Unverified	0
Diffusion Models as Optimizers for Efficient Planning in Offline RL	Jul 23, 2024	D4RLDecision Making	CodeCode Available	0
Offline Reinforcement Learning with Imputed Rewards	Jul 15, 2024	D4RLreinforcement-learning	—Unverified	0
Aligning Diffusion Behaviors with Q-functions for Efficient Continuous Control	Jul 12, 2024	continuous-controlContinuous Control	CodeCode Available	1
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning	Jun 30, 2024	D4RLOffline RL	—Unverified	0
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning	Jun 14, 2024	D4RLOffline RL	—Unverified	0
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning	Jun 13, 2024	D4RLOffline RL	—Unverified	0
SeMOPO: Learning High-quality Model and Policy from Low-quality Offline Visual Datasets	Jun 13, 2024	D4RLOffline RL	—Unverified	0
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning	Jun 12, 2024	D4RLMuJoCo	CodeCode Available	0
CDSA: Conservative Denoising Score-based Algorithm for Offline Reinforcement Learning	Jun 11, 2024	D4RLDenoising	—Unverified	0
PlanDQ: Hierarchical Plan Orchestration via D-Conductor and Q-Performer	Jun 10, 2024	continuous-controlContinuous Control	CodeCode Available	1
Stabilizing Extreme Q-learning by Maclaurin Expansion	Jun 7, 2024	D4RLOffline RL	CodeCode Available	0
Strategically Conservative Q-Learning	Jun 6, 2024	D4RLOffline RL	CodeCode Available	1
UDQL: Bridging The Gap between MSE Loss and The Optimal Value Function in Offline Reinforcement Learning	Jun 5, 2024	D4RLOffline RL	—Unverified	0
Decision Mamba: Reinforcement Learning via Hybrid Selective Sequence Modeling	May 31, 2024	D4RLMamba	—Unverified	0
Diffusion Actor-Critic: Formulating Constrained Policy Iteration as Diffusion Noise Regression for Offline Reinforcement Learning	May 31, 2024	D4RLReinforcement Learning (RL)	CodeCode Available	1
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought	May 31, 2024	D4RLDecision Making	CodeCode Available	1
Learning from Random Demonstrations: Offline Reinforcement Learning with Importance-Sampled Diffusion Models	May 30, 2024	D4RLreinforcement-learning	—Unverified	0
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning	May 30, 2024	D4RLDecision Making	—Unverified	0
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning	May 30, 2024	D4RLreinforcement-learning	CodeCode Available	1

Show:10 25 50

← PrevPage 3 of 10Next →

No leaderboard results yet.