SOTAVerified

Offline RL

Papers

Showing 326–350 of 755 papers

TitleStatusHype
Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement LearningCode1
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps—0
Robotic Offline RL from Internet Videos via Value-Function Pre-Training—0
Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions—0
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning—0
Equivariant Data Augmentation for Generalization in Offline Reinforcement Learning—0
VAPOR: Legged Robot Navigation in Outdoor Vegetation Using Offline Reinforcement LearningCode1
Reasoning with Latent Diffusion in Offline Reinforcement LearningCode1
ORL-AUDITOR: Dataset Auditing in Offline Deep Reinforcement LearningCode1
Model-based Offline Policy Optimization with Adversarial NetworkCode0
Hundreds Guide Millions: Adaptive Offline Reinforcement Learning with Expert Guidance—0
Multi-Objective Decision Transformers for Offline Reinforcement Learning—0
Reinforced Self-Training (ReST) for Language Modeling—0
Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World—0
Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations—0
AlphaStar Unplugged: Large-Scale Offline Reinforcement LearningCode2
Integrating Offline Reinforcement Learning with Transformers for Sequential Recommendation—0
Contrastive Example-Based ControlCode0
A Connection between One-Step Regularization and Critic Regularization in Reinforcement LearningCode0
On the Effectiveness of Offline RL for Dialogue Response GenerationCode0
Model-based Offline Reinforcement Learning with Count-based ConservatismCode0
PASTA: Pretrained Action-State Transformer Agents—0
Towards Self-Assembling Artificial Neural Networks through Neural Developmental ProgramsCode1
Robotic Manipulation Datasets for Offline Compositional Reinforcement LearningCode1
Budgeting Counterfactual for Offline RL—0
Show:102550
← PrevPage 14 of 31Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1KFCAverage Reward81.8—Unverified
2ADMPOAverage Reward81—Unverified
3Decision Transformer (DT)Average Reward73.5—Unverified
#ModelMetricClaimedVerifiedStatus
1ParPID4RL Normalized Score151.4—Unverified