A Cooperation Graph Approach for Multiagent Sparse Reward Reinforcement Learning Aug 5, 2022 reinforcement-learning Reinforcement Learning
Code Code Available 25 Dialogue Learning With Human-In-The-Loop Nov 29, 2016 Question Answering reinforcement-learning
Code Code Available 25 Diffusion Actor-Critic with Entropy Regulator May 24, 2024 Decision Making MuJoCo
Code Code Available 25 EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data Mar 1, 2024 continuous-control Continuous Control
Code Code Available 25 MetaDrive: Composing Diverse Driving Scenarios for Generalizable Reinforcement Learning Sep 26, 2021 Benchmarking Decision Making
Code Code Available 25 AMAGO-2: Breaking the Multi-Task Barrier in Meta-Reinforcement Learning with Transformers Nov 17, 2024 In-Context Learning Meta-Learning
Code Code Available 25 Demonstration-Guided Reinforcement Learning with Efficient Exploration for Task Automation of Surgical Robot Feb 20, 2023 Efficient Exploration reinforcement-learning
Code Code Available 25 A Tutorial on Bayesian Optimization of Expensive Cost Functions, with Application to Active User Modeling and Hierarchical Reinforcement Learning Dec 12, 2010 Bayesian Optimization Hierarchical Reinforcement Learning
Code Code Available 25 AMP: Adversarial Motion Priors for Stylized Physics-Based Character Control Apr 5, 2021 Imitation Learning Reinforcement Learning (RL)
Code Code Available 25 Challenges and Opportunities in Offline Reinforcement Learning from Visual Observations Jun 9, 2022 Benchmarking continuous-control
Code Code Available 25 MO-Gym: A Library of Multi-Objective Reinforcement Learning Environments Nov 30, 2022 Multi-Objective Reinforcement Learning OpenAI Gym
Code Code Available 25 MOMAland: A Set of Benchmarks for Multi-Objective Multi-Agent Reinforcement Learning Jul 23, 2024 Benchmarking Decision Making
Code Code Available 25 Deep Reinforcement Learning in a Handful of Trials using Probabilistic Dynamics Models May 30, 2018 Deep Reinforcement Learning Model-based Reinforcement Learning
Code Code Available 25 A Toolkit for Reliable Benchmarking and Research in Multi-Objective Reinforcement Learning Sep 26, 2023 Benchmarking Multi-Objective Reinforcement Learning
Code Code Available 25 Multi-Agent Reinforcement Learning is a Sequence Modeling Problem May 30, 2022 Decision Making MuJoCo
Code Code Available 25 GenRL: Multimodal-foundation world models for generalization in embodied agents Jun 26, 2024 Benchmarking Reinforcement Learning (RL)
Code Code Available 25 Revocable Deep Reinforcement Learning with Affinity Regularization for Outlier-Robust Graph Matching Dec 16, 2020 Combinatorial Optimization Decision Making
Code Code Available 25 Deep Reinforcement Learning for Multi-Agent Interaction Aug 2, 2022 BIG-bench Machine Learning Causal Inference
Code Code Available 25 DEP-RL: Embodied Exploration for Reinforcement Learning in Overactuated and Musculoskeletal Systems May 30, 2022 Diversity reinforcement-learning
Code Code Available 25 NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation Apr 17, 2025 Data Augmentation Diversity
Code Code Available 25 ODRL: A Benchmark for Off-Dynamics Reinforcement Learning Oct 28, 2024 Benchmarking reinforcement-learning
Code Code Available 25 Offline Reinforcement Learning for LLM Multi-Step Reasoning Dec 20, 2024 GSM8K Math
Code Code Available 25 A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges Nov 12, 2022 reinforcement-learning Reinforcement Learning
Code Code Available 25 Datasets and Benchmarks for Offline Safe Reinforcement Learning Jun 15, 2023 Autonomous Driving Benchmarking
Code Code Available 25 D4RL: Datasets for Deep Data-Driven Reinforcement Learning Apr 15, 2020 D4RL Offline RL
Code Code Available 25 Curiosity-driven Red-teaming for Large Language Models Feb 29, 2024 Red Teaming Reinforcement Learning (RL)
Code Code Available 25 Assessment of Reinforcement Learning for Macro Placement Feb 21, 2023 Deep Reinforcement Learning reinforcement-learning
Code Code Available 25 DayDreamer: World Models for Physical Robot Learning Jun 28, 2022 Deep Reinforcement Learning Navigate
Code Code Available 25 Think or Not Think: A Study of Explicit Thinking in Rule-Based Visual Reinforcement Fine-Tuning Mar 20, 2025 Classification Few-Shot Learning
Code Code Available 25 CodeRL: Mastering Code Generation through Pretrained Models and Deep Reinforcement Learning Jul 5, 2022 Code Generation Decoder
Code Code Available 25 AndroidEnv: A Reinforcement Learning Platform for Android May 27, 2021 reinforcement-learning Reinforcement Learning
Code Code Available 25 Craftium: An Extensible Framework for Creating Reinforcement Learning Environments Jul 4, 2024 Benchmarking Minecraft
Code Code Available 25 AutoTriton: Automatic Triton Programming with Reinforcement Learning in LLMs Jul 8, 2025 GPU reinforcement-learning
Code Code Available 25 Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving May 12, 2025 Math Mathematical Problem-Solving
Code Code Available 25 CTR-Driven Advertising Image Generation with Multimodal Large Language Models Feb 5, 2025 Image Generation Reinforcement Learning (RL)
Code Code Available 25 Decoupling Representation Learning from Reinforcement Learning Sep 14, 2020 Data Augmentation Deep Reinforcement Learning
Code Code Available 25 Developing A Multi-Agent and Self-Adaptive Framework with Deep Reinforcement Learning for Dynamic Portfolio Risk Management Feb 1, 2024 Deep Reinforcement Learning Management
Code Code Available 25 ElegantRL-Podracer: Scalable and Elastic Library for Cloud-Native Deep Reinforcement Learning Dec 11, 2021 Deep Reinforcement Learning GPU
Code Code Available 25 Hokoff: Real Game Dataset from Honor of Kings and its Offline Reinforcement Learning Benchmarks Aug 20, 2024 Multi-agent Reinforcement Learning Multi-Task Learning
Code Code Available 25 Physics-based Deep Learning Sep 11, 2021 Deep Learning Physical Simulations
Code Code Available 25 A simple but strong baseline for online continual learning: Repeated Augmented Rehearsal Sep 28, 2022 Continual Learning Reinforcement Learning (RL)
Code Code Available 15 A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning Oct 10, 2022 Data Augmentation reinforcement-learning
Code Code Available 15 Control-Informed Reinforcement Learning for Chemical Processes Aug 24, 2024 Deep Reinforcement Learning reinforcement-learning
Code Code Available 15 A Composable Specification Language for Reinforcement Learning Tasks Aug 21, 2020 reinforcement-learning Reinforcement Learning
Code Code Available 15 A Boolean Task Algebra for Reinforcement Learning Jan 6, 2020 Lifelong learning Negation
Code Code Available 15 Controlgym: Large-Scale Control Environments for Benchmarking Reinforcement Learning Algorithms Nov 30, 2023 Benchmarking OpenAI Gym
Code Code Available 15 Controlling the Risk of Conversational Search via Reinforcement Learning Jan 15, 2021 Conversational Search reinforcement-learning
Code Code Available 15 Contrastive State Augmentations for Reinforcement Learning-Based Recommender Systems May 18, 2023 Recommendation Systems reinforcement-learning
Code Code Available 15 Scalable Multi-agent Reinforcement Learning Algorithm for Wireless Networks Aug 1, 2021 Decision Making Multi-agent Reinforcement Learning
Code Code Available 15 Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning Jul 29, 2022 Contrastive Learning Deep Reinforcement Learning
Code Code Available 15