SOTAVerified

Hierarchical Reinforcement Learning

Papers

Showing 1–50 of 384 papers

TitleStatusHype
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning—0
Tailored Conversations beyond LLMs: A RL-Based Dialogue Manager—0
Hierarchical Reinforcement Learning and Value Optimization for Challenging Quadruped Locomotion—0
HiLight: A Hierarchical Reinforcement Learning Framework with Global Adversarial Guidance for Large-Scale Traffic Signal Control—0
Discovering Temporal Structure: An Overview of Hierarchical Reinforcement Learning—0
SkillBlender: Towards Versatile Humanoid Whole-Body Loco-Manipulation via Skill BlendingCode2
From Debate to Equilibrium: Belief-Driven Multi-Agent LLM Reasoning via Bayesian Nash EquilibriumCode1
Discounting and Drug Seeking in Biological Hierarchical Reinforcement Learning—0
MRSD: Multi-Resolution Skill Discovery for HRL Agents—0
Divide and Conquer: Grounding LLMs as Efficient Decision-Making Agents via Offline Hierarchical Reinforcement LearningCode2
Let Humanoids Hike! Integrative Skill Development on Complex Trails—0
Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning—0
Implicitly Aligning Humans and Autonomous Agents through Shared Task AbstractionsCode0
ReeM: Ensemble Building Thermodynamics Model for Efficient HVAC Control via Hierarchical Reinforcement Learning—0
D3HRL: A Distributed Hierarchical Reinforcement Learning Approach Based on Causal Discovery and Spurious Correlation Detection—0
Hierarchical Reinforcement Learning in Multi-Goal Spatial Navigation with Autonomous Mobile Robots—0
Federated Hierarchical Reinforcement Learning for Adaptive Traffic Signal Control—0
Solving Sokoban using Hierarchical Reinforcement Learning with LandmarksCode0
A tale of two goals: leveraging sequentiality in multi-goal scenarios—0
Option Discovery Using LLM-guided Semantic Hierarchical Reinforcement Learning—0
Learning with Expert Abstractions for Efficient Multi-Task Continuous ControlCode0
Hierarchical Reinforcement Learning for Safe Mapless Navigation with Congestion Estimation—0
Multi-Turn Code Generation Through Single-Step RewardsCode1
TAG: A Decentralized Framework for Multi-Agent Hierarchical Reinforcement LearningCode0
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought TemplatesCode4
DHP: Discrete Hierarchical Planning for Hierarchical Reinforcement Learning Agents—0
Certificated Actor-Critic: Hierarchical Reinforcement Learning with Control Barrier Functions for Safe Navigation—0
Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning—0
A Hierarchical Reinforcement Learning Framework for Multi-UAV Combat Using Leader-Follower Strategy—0
Attention-Driven Hierarchical Reinforcement Learning with Particle Filtering for Source Localization in Dynamic Fields—0
Hierarchical Reinforcement Learning for Optimal Agent Grouping in Cooperative Systems—0
Enhancing Workplace Productivity and Well-being Using AI Agent—0
Scalable Hierarchical Reinforcement Learning for Hyper Scale Multi-Robot Task Planning—0
Autonomous Option Invention for Continual Hierarchical Reinforcement Learning and PlanningCode0
Active Geospatial Search for Efficient Tenant Eviction Outreach—0
Simulation-Free Hierarchical Latent Policy Planning for Proactive Dialogues—0
Accelerating Task Generalisation with Multi-Level Skill Hierarchies—0
Guiding Multi-agent Multi-task Reinforcement Learning by a Hierarchical Framework with Logical Reward Shaping—0
Demystifying Linear MDPs and Novel Dynamics Aggregation Framework—0
VisualPredicator: Learning Abstract World Models with Neuro-Symbolic Predicates for Robot Planning—0
Copyright-Aware Incentive Scheme for Generative Art Models Using Hierarchical Reinforcement Learning—0
Hierarchical Reinforced Trader (HRT): A Bi-Level Approach for Optimizing Stock Selection and Execution—0
RecoveryChaining: Learning Local Recovery Policies for Robust Manipulation—0
Disentangled Unsupervised Skill Discovery for Efficient Hierarchical Reinforcement Learning—0
HG2P: Hippocampus-inspired High-reward Graph and Model-Free Q-Gradient Penalty for Path Planning and Motion ControlCode0
Hierarchical Universal Value Function Approximators—0
Meta-Learning Integration in Hierarchical Reinforcement Learning for Advanced Task ComplexityCode0
Offline Hierarchical Reinforcement Learning via Inverse Optimization—0
Unsupervised Skill Discovery for Robotic Manipulation through Automatic Task Generation—0
Diffusion Meets Options: Hierarchical Generative Skill Composition for Temporally-Extended Tasks—0
Show:102550
← PrevPage 1 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1STARReturn0.85—Unverified