SOTAVerified

Decision Making Under Uncertainty

Papers

Showing 1–50 of 263 papers

TitleStatusHype
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards—0
Toward Explainable Offline RL: Analyzing Representations in Intrinsically Motivated Decision Transformers—0
The Gittins Index: A Design Principle for Decision-Making Under Uncertainty—0
Q-ARDNS-Multi: A Multi-Agent Quantum Reinforcement Learning Framework with Meta-Cognitive Adaptation for Complex 3D Environments—0
Cognitive Guardrails for Open-World Decision Making in Autonomous Drone Swarms—0
Embodied AI with Foundation Models for Mobile Service Robots: A Systematic Review—0
Synthetic Time Series Forecasting with Transformer Architectures: Extensive Simulation BenchmarksCode0
Comparing Exploration-Exploitation Strategies of LLMs and Humans: Insights from Standard Multi-armed Bandit TasksCode1
rfPG: Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs—0
A Multi-Agent Reinforcement Learning Approach for Cooperative Air-Ground-Human Crowdsensing in Emergency Rescue—0
Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints—0
ICNN-enhanced 2SP: Leveraging input convex neural networks for solving two-stage stochastic programmingCode0
Primal-dual algorithm for contextual stochastic combinatorial optimization—0
Learning Symbolic Persistent Macro-Actions for POMDP Solving Over Time—0
LLM-Guided Probabilistic Program Induction for POMDP Model Estimation—0
Measures of Variability for Risk-averse Policy Gradient—0
Wasserstein Distributionally Robust Regret Optimization—0
Towards More Efficient, Robust, Instance-adaptive, and Generalizable Sequential Decision making—0
Efficient Portfolio Selection through Preference Aggregation with Quicksort and the Bradley--Terry Model—0
Counterfactual Inference under Thompson Sampling—0
A friendly introduction to triangular transportCode1
Active Inference for Energy Control and Planning in Smart Buildings and Communities—0
NeuroSep-CP-LCB: A Deep Learning-based Contextual Multi-armed Bandit Algorithm with Uncertainty Quantification for Early Sepsis PredictionCode0
Truthful Elicitation of Imprecise Forecasts—0
Statistical Inference for Weighted Sample Average Approximation in Contextual Stochastic Optimization—0
Local-Global Learning of Interpretable Control Policies: The Interface between MPC and Reinforcement Learning—0
A Weighted Predict-and-Optimize Framework for Power System Operation Considering Varying Impacts of Uncertainty—0
Hierarchical Neuro-Symbolic Decision Transformer—0
Quantum-Inspired Reinforcement Learning in the Presence of Epistemic Ambivalence—0
Map Space Belief Prediction for Manipulation-Enhanced Mapping—0
Does Knowledge About Perceptual Uncertainty Help an Agent in Automated Driving?—0
Learning Fair Policies for Infectious Diseases Mitigation using Path Integral Control—0
Words or Numbers? How Framing Uncertainties Affects Risk Assessment and Decision-Making—0
Online Clustering of Dueling Bandits—0
Anytime Incremental ρPOMDP Planning in Continuous Spaces—0
A Model-free Biomimetics Algorithm for Deterministic Partially Observable Markov Decision Process—0
Online MDP with Transition Prototypes: A Robust Adaptive Approach—0
Selective Reviews of Bandit Problems in AI via a Statistical View—0
Decision Making under the Exponential Family: Distributionally Robust Optimisation with Bayesian Ambiguity Sets—0
Explainable Finite-Memory Policies for Partially Observable Markov Decision Processes—0
Fair Secretaries with Unfair Predictions—0
Hierarchical Upper Confidence Bounds for Constrained Online Learning—0
System-Level Analysis of Module Uncertainty Quantification in the Autonomy Pipeline—0
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes—0
Crafting desirable climate trajectories with RL explored socio-environmental simulationsCode0
EVOLvE: Evaluating and Optimizing LLMs For Exploration—0
Functional Clustering of Discount Functions for Behavioral Investor Profiling—0
End-to-End Conformal Calibration for Optimization Under UncertaintyCode1
Mitigating optimistic bias in entropic risk estimation and optimization with an application to insurance—0
Rao-Blackwellized POMDP Planning—0
Show:102550
← PrevPage 1 of 6Next →

No leaderboard results yet.