SOTAVerified

Decision Making Under Uncertainty

Papers

Showing 151–200 of 263 papers

TitleStatusHype
Information Directed Sampling for Linear Partial Monitoring—0
Information efficient learning of complexly structured preferences: Elicitation procedures and their application to decision making under uncertainty—0
Investigation of Uncertainty of Deep Learning-based Object Classification on Radar Spectra—0
Knowledge-Based Sequential Decision-Making Under Uncertainty—0
Large-scale optimization with the primal-dual column generation method—0
Learning Fair Policies for Infectious Diseases Mitigation using Path Integral Control—0
Learning for Multi-robot Cooperation in Partially Observable Stochastic Environments with Macro-actions—0
Learning Successor Features with Distributed Hebbian Temporal Memory—0
Learning Symbolic Persistent Macro-Actions for POMDP Solving Over Time—0
Leaving the Nest: Going Beyond Local Loss Functions for Predict-Then-Optimize—0
Legion: Best-First Concolic Testing—0
Linear Stochastic Bandits over a Bit-Constrained Channel—0
LLM-Guided Probabilistic Program Induction for POMDP Model Estimation—0
Local-Global Learning of Interpretable Control Policies: The Interface between MPC and Reinforcement Learning—0
Macro-Action-Based Deep Multi-Agent Reinforcement Learning—0
Macro-Action-Based Multi-Agent/Robot Deep Reinforcement Learning under Partial Observability—0
Map Space Belief Prediction for Manipulation-Enhanced Mapping—0
Measures of Variability for Risk-averse Policy Gradient—0
Modeling Boundedly Rational Agents with Latent Inference Budgets—0
Modelling Dynamic Interactions between Relevance Dimensions—0
Multi-Armed Bandits With Machine Learning-Generated Surrogate Rewards—0
Multicriteria Group Decision-Making Under Uncertainty Using Interval Data and Cloud Models—0
Natural Language Generation enhances human decision-making with uncertain information—0
No DBA? No regret! Multi-armed bandits for index tuning of analytical and HTAP workloads with provable guarantees—0
(Non-)Commutative Aggregation—0
Non-stationary Delayed Combinatorial Semi-Bandit with Causally Related Rewards—0
Novel Exploration Techniques (NETs) for Malaria Policy Interventions—0
Observation-Augmented Contextual Multi-Armed Bandits for Robotic Search and Exploration—0
On Algorithmic Decision Procedures in Emergency Response Systems in Smart and Connected Communities—0
On a notion of independence proposed by Teddy Seidenfeld—0
On Hashing-Based Approaches to Approximate DNF-Counting—0
Online Clustering of Dueling Bandits—0
Online MDP with Transition Prototypes: A Robust Adaptive Approach—0
Online Planning Algorithms for POMDPs—0
Online POMDP Planning with Anytime Deterministic Optimality Guarantees—0
On the Expressivity of Multidimensional Markov Reward—0
Optimal Immunization Policy Using Dynamic Programming—0
Optimal Sensing via Multi-armed Bandit Relaxations in Mixed Observability Domains—0
Optimization under Uncertainty in the Era of Big Data and Deep Learning: When Machine Learning Meets Mathematical Programming—0
Parallelizing Contextual Bandits—0
Partial Law Invariance and Risk Measures—0
Partially Observable Stochastic Games with Neural Perception Mechanisms—0
Playing against Nature: causal discovery for decision making under uncertainty—0
Point-Based Value Iteration for POMDPs with Neural Perception Mechanisms—0
Mean-Variance Efficient Reinforcement Learning with Applications to Dynamic Financial Investment—0
A Posteriori Probabilistic Bounds of Convex Scenario Programs with Validation Tests—0
Practical Bandits: An Industry Perspective—0
Learning-to-defer for sequential medical decision-making under uncertainty—0
Reference Points, Risk-Taking Behavior, and Competitive Outcomes in Sequential Settings—0
Primal-dual algorithm for contextual stochastic combinatorial optimization—0
Show:102550
← PrevPage 4 of 6Next →

No leaderboard results yet.