SOTAVerified

Meta Reinforcement Learning

Papers

Showing 1–50 of 278 papers

TitleStatusHype
Meta-Reinforcement Learning for Fast and Data-Efficient Spectrum Allocation in Dynamic Wireless Networks—0
Learning Task Belief Similarity with Latent Dynamics for Meta-Reinforcement LearningCode0
Scaling Algorithm Distillation for Continuous Control with Mamba—0
Unsupervised Meta-Testing with Conditional Neural Processes for Hybrid Meta-Reinforcement Learning—0
Bayesian Meta-Reinforcement Learning with Laplace Variational Recurrent NetworksCode0
Meta-reinforcement learning with minimum attention—0
Meta-World+: An Improved, Standardized, RL BenchmarkCode5
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments—0
InstructRAG: Leveraging Retrieval-Augmented Generation on Instruction Graphs for LLM-Based Task Planning—0
Embodied World Models Emerge from Navigational Task in Open-Ended Environments—0
UAS Visual Navigation in Large and Unseen Environments via a Meta Agent—0
Meta-Reinforcement Learning with Discrete World Models for Adaptive Load Balancing—0
Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning—0
Teleology-Driven Affective Computing: A Causal Framework for Sustained Well-Being—0
PRISM: A Robust Framework for Skill-based Meta-Reinforcement Learning with Noisy Demonstrations—0
Task-Aware Virtual Training: Enhancing Generalization in Meta-Reinforcement Learning for Out-of-Distribution TasksCode0
Coreset-Based Task Selection for Sample-Efficient Meta-Reinforcement LearningCode0
Toward Task Generalization via Memory Augmentation in Meta-Reinforcement Learning—0
TIMRL: A Novel Meta-Reinforcement Learning Framework for Non-Stationary and Multi-Task Environments—0
Hierarchical Multi-agent Meta-Reinforcement Learning for Cross-channel Bidding—0
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement LearningCode0
Hierarchical Meta-Reinforcement Learning via Automated Macro-Action Discovery—0
Mind the Gap: Towards Generalizable Autonomous Penetration Testing via Domain Randomization and Meta-Reinforcement LearningCode1
Emergence of Implicit World Models from Mortal Agents—0
AMAGO-2: Breaking the Multi-Task Barrier in Meta-Reinforcement Learning with TransformersCode2
Enabling Adaptive Agent Training in Open-Ended Simulators by Targeting DiversityCode0
FALCON: Feedback-driven Adaptive Long/short-term memory reinforced Coding Optimization systemCode0
Stable Hadamard Memory: Revitalizing Memory-Augmented Agents for Reinforcement LearningCode1
Meta-Reinforcement Learning with Universal Policy Adaptation: Provable Near-Optimality under All-task Optimum Comparator—0
Meta Reinforcement Learning Approach for Adaptive Resource Optimization in O-RAN—0
Solving Truly Massive Budgeted Monotonic POMDPs with Oracle-Guided Meta-Reinforcement Learning—0
Importance Sampling-Guided Meta-Training for Intelligent Agents in Highly Interactive Environments—0
Constrained Meta Agnostic Reinforcement Learning—0
Memory Sequence Length of Data Sampling Impacts the Adaptation of Meta-Reinforcement Learning Agents—0
Skill-aware Mutual Information Optimisation for Generalisation in Reinforcement LearningCode1
Test-Time Regret Minimization in Meta Reinforcement Learning—0
A CMDP-within-online framework for Meta-Safe Reinforcement Learning—0
Theoretical Analysis of Meta Reinforcement Learning: Generalization Bounds and Convergence Guarantees—0
Scrutinize What We Ignore: Reining In Task Representation Shift Of Context-Based Offline Meta Reinforcement LearningCode0
On the Performance of Unmanned Aerial Vehicles with MIMO VLC—0
Meta Reinforcement Learning for Resource Allocation in Multi-Antenna UAV Network with Rate Splitting Multiple Access—0
Sequential Decision Making with Expert Demonstrations under Unobserved HeterogeneityCode0
MAMBA: an Effective World Model Approach for Meta-Reinforcement LearningCode1
Disentangling Policy from Offline Task Representation Learning via Adversarial Data AugmentationCode0
SplAgger: Split Aggregation for Meta-Reinforcement LearningCode1
DynaMITE-RL: A Dynamic Model for Improved Temporal Meta-Reinforcement Learning—0
Hierarchical Transformers are Efficient Meta-Reinforcement Learners—0
Analysing the Sample Complexity of Opponent Shaping—0
In-context learning agents are asymmetric belief updaters—0
Learning to Abstract Visuomotor Mappings using Meta-Reinforcement Learning—0
Show:102550
← PrevPage 1 of 6Next →

No leaderboard results yet.