SOTAVerified

Meta Reinforcement Learning

Papers

Showing 51–100 of 278 papers

TitleStatusHype
Towards an Information Theoretic Framework of Context-Based Offline Meta-Reinforcement LearningCode1
Meta Reinforcement Learning for Strategic IoT Deployments Coverage in Disaster-Response UAV Swarms—0
Towards an Adaptable and Generalizable Optimization Engine in Decision and Control: A Meta Reinforcement Learning Approach—0
Meta Reinforcement Learning for Multi-Task Offloading in Vehicular Edge Computing—0
Generalizable Task Representation Learning for Offline Meta-Reinforcement Learning with Data LimitationsCode0
XLand-MiniGrid: Scalable Meta-Reinforcement Learning Environments in JAXCode2
Constrained Meta-Reinforcement Learning for Adaptable Safety Guarantee with Differentiable Convex ProgrammingCode0
Decoupling Meta-Reinforcement Learning with Gaussian Task Contexts and SkillsCode0
On Task-Relevant Loss Functions in Meta-Reinforcement Learning and Online LQR—0
Evolving Reservoirs for Meta Reinforcement LearningCode2
Adaptive Agents and Data Quality in Agent-Based Financial Markets—0
An MRL-Based Design Solution for RIS-Assisted MU-MIMO Wireless System under Time-Varying Channels—0
Data-Efficient Task Generalization via Probabilistic Model-based Meta Reinforcement Learning—0
An introduction to reinforcement learning for neuroscience—0
Dream to Adapt: Meta Reinforcement Learning by Latent Context Imagination and MDP Imagination—0
Context Shift Reduction for Offline Meta-Reinforcement LearningCode1
Hypothesis Network Planned Exploration for Rapid Meta-Reinforcement Learning Adaptation—0
Emergence of Collective Open-Ended Exploration from Decentralized Meta-Reinforcement Learning—0
Neurosymbolic Meta-Reinforcement Lookahead Learning Achieves Safe Self-Driving in Non-Stationary Environments—0
Robust Driving Policy Learning with Guided Meta Reinforcement Learning—0
RL^3: Boosting Meta Reinforcement Learning via RL inside RL^2Code0
Meta Generative Flow Networks with Personalization for Task-Specific Adaptation—0
Simple Embodied Language Learning as a Byproduct of Meta-Reinforcement Learning—0
Stepsize Learning for Policy Gradient Methods in Contextual Markov Decision Processes—0
ContraBAR: Contrastive Bayes-Adaptive Deep RLCode1
Offline Meta Reinforcement Learning with In-Distribution Online AdaptationCode0
Doing the right thing for the right reason: Evaluating artificial moral cognition by probing cost insensitivity—0
On First-Order Meta-Reinforcement Learning with Moreau Envelopes—0
Meta-Reinforcement Learning Based on Self-Supervised Task Representation Learning—0
On Context Distribution Shift in Task Representation Learning for Offline Meta RLCode0
Meta-Reinforcement Learning via Exploratory Task Clustering—0
Procedural generation of meta-reinforcement learning tasksCode1
A Survey of Meta-Reinforcement Learning—0
Human-Timescale Adaptation in an Open-Ended Task Space—0
Neuro-symbolic Meta Reinforcement Learning for Trading—0
POMRL: No-Regret Learning-to-Plan with Increasing Horizons—0
Cognitive Level-k Meta-Learning for Safe and Pedestrian-Aware Autonomous Driving—0
Active learning using adaptable task-based prioritisation—0
Efficient Meta Reinforcement Learning for Preference-based Fast AdaptationCode1
Contextual Transformer for Offline Meta Reinforcement Learning—0
BIMRL: Brain Inspired Meta Reinforcement LearningCode1
Meta-Reinforcement Learning Using Model Parameters—0
Uncertainty-based Meta-Reinforcement Learning for Robust Radar Tracking—0
MetaEMS: A Meta Reinforcement Learning-based Control Framework for Building Energy Management System—0
Hypernetworks in Meta-Reinforcement LearningCode1
Meta-Learning with Self-Improving Momentum TargetCode1
Decomposed Mutual Information Optimization for Generalized Context in Meta-Reinforcement LearningCode1
Meta Reinforcement Learning for Optimal Design of Legged Robots—0
Distributionally Adaptive Meta Reinforcement Learning—0
Zero-Shot Policy Transfer with Disentangled Task Representation of Meta-Reinforcement Learning—0
Show:102550
← PrevPage 2 of 6Next →

No leaderboard results yet.