Doubly Robust Policy Evaluation and Learning Mar 23, 2011 Decision Making Multi-Armed Bandits
Code Code Available 05 Efficient Algorithms for Extreme Bandits Mar 21, 2022 Multi-Armed Bandits
Code Code Available 05 Online SuBmodular + SuPermodular (BP) Maximization with Bandit Feedback Jul 7, 2022 Computational Efficiency Movie Recommendation
Code Code Available 05 Intrinsically Efficient, Stable, and Bounded Off-Policy Evaluation for Reinforcement Learning Jun 9, 2019 Multi-Armed Bandits Off-policy evaluation
Code Code Available 05 From Complexity to Simplicity: Adaptive ES-Active Subspaces for Blackbox Optimization Mar 7, 2019 compressed sensing Multi-Armed Bandits
Code Code Available 05 Invariant Policy Learning: A Causal Perspective Jun 1, 2021 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Distributionally Robust Policy Evaluation under General Covariate Shift in Contextual Bandits Jan 21, 2024 Multi-Armed Bandits regression
Code Code Available 05 Kernel Conditional Moment Constraints for Confounding Robust Inference Feb 26, 2023 Multi-Armed Bandits Sensitivity
Code Code Available 05 RoME: A Robust Mixed-Effects Bandit Algorithm for Optimizing Mobile Health Interventions Dec 11, 2023 Multi-Armed Bandits Off-policy evaluation
Code Code Available 05 Antithetic Sampling for Top-k Shapley Identification Apr 2, 2025 Multi-Armed Bandits
Code Code Available 05 AC-Band: A Combinatorial Bandit-Based Approach to Algorithm Configuration Dec 1, 2022 Multi-Armed Bandits
Code Code Available 05 Learning Structural Weight Uncertainty for Sequential Decision-Making Dec 30, 2017 Decision Making Multi-Armed Bandits
Code Code Available 05 Let's Get It Started: Fostering the Discoverability of New Releases on Deezer Jan 5, 2024 Multi-Armed Bandits
Code Code Available 05 Linear Contextual Bandits with Hybrid Payoff: Revisited Jun 14, 2024 Diversity Multi-Armed Bandits
Code Code Available 05 Approximating a Target Distribution using Weight Queries Jun 24, 2020 Domain Adaptation Multi-Armed Bandits
Code Code Available 05 Local Metric Learning for Off-Policy Evaluation in Contextual Bandits with Continuous Actions Oct 24, 2022 Metric Learning Multi-Armed Bandits
Code Code Available 05 Adversarial Attacks on Combinatorial Multi-Armed Bandits Oct 8, 2023 Multi-Armed Bandits
Code Code Available 05 MABSplit: Faster Forest Training Using Multi-Armed Bandits Dec 14, 2022 Feature Importance Multi-Armed Bandits
Code Code Available 05 Adapting multi-armed bandits policies to contextual bandits scenarios Nov 11, 2018 Binary Classification Classification
Code Code Available 05 Meta-in-context learning in large language models May 22, 2023 In-Context Learning Multi-Armed Bandits
Code Code Available 05 Mitigating Exposure Bias in Online Learning to Rank Recommendation: A Novel Reward Model for Cascading Bandits Aug 8, 2024 Exposure Fairness Fairness
Code Code Available 05 Model-free Reinforcement Learning in Infinite-horizon Average-reward Markov Decision Processes Oct 15, 2019 Multi-Armed Bandits reinforcement-learning
Code Code Available 05 A Survey of Online Experiment Design with the Stochastic Multi-Armed Bandit Oct 2, 2015 Decision Making Multi-Armed Bandits
Code Code Available 05 Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach Aug 21, 2023 Decision Making Multi-Armed Bandits
Code Code Available 05 A Survey on Contextual Multi-armed Bandits Aug 13, 2015 Multi-Armed Bandits Survey
Code Code Available 05 Multi-armed bandits for resource efficient, online optimization of language model pre-training: the use case of dynamic masking Mar 24, 2022 Bayesian Optimization Decision Making
Code Code Available 05 Deep Bayesian Bandits Showdown: An Empirical Comparison of Bayesian Deep Networks for Thompson Sampling Feb 26, 2018 Decision Making Deep Reinforcement Learning
Code Code Available 05 Doubly-Robust Lasso Bandit Jul 26, 2019 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Contextual Bandits with Stochastic Experts Feb 23, 2018 Multi-Armed Bandits
Code Code Available 05 Contextual Bandits with Large Action Spaces: Made Practical Jul 12, 2022 Decision Making Multi-Armed Bandits
Code Code Available 05 Contextual Linear Bandits under Noisy Features: Towards Bayesian Oracles Mar 3, 2017 Multi-Armed Bandits
Code Code Available 05 Adaptive Action Duration with Contextual Bandits for Deep Reinforcement Learning in Dynamic Environments Jun 17, 2025 Atari Games Board Games
Code Code Available 05 Confidence Intervals for Policy Evaluation in Adaptive Experiments Nov 7, 2019 Experimental Design Multi-Armed Bandits
Code Code Available 05 Flooding with Absorption: An Efficient Protocol for Heterogeneous Bandits over Complex Networks Mar 9, 2023 Decision Making Multi-Armed Bandits
Code Code Available 05 A Field Test of Bandit Algorithms for Recommendations: Understanding the Validity of Assumptions on Human Preferences in Multi-armed Bandits Apr 16, 2023 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Confident Off-Policy Evaluation and Selection through Self-Normalized Importance Weighting Jun 18, 2020 Multi-Armed Bandits Off-policy evaluation
Code Code Available 05 Corralling a Band of Bandit Algorithms Dec 19, 2016 Multi-Armed Bandits
Code Code Available 05 Conditionally Risk-Averse Contextual Bandits Oct 24, 2022 Management Multi-Armed Bandits
Code Code Available 05 Constrained regret minimization for multi-criterion multi-armed bandits Jun 17, 2020 Attribute Multi-Armed Bandits
Code Code Available 05 Contextual bandits with entropy-based human feedback Feb 12, 2025 Multi-Armed Bandits
Code Code Available 05 Contextual Bandits with Smooth Regret: Efficient Learning in Continuous Action Spaces Jul 12, 2022 continuous-control Continuous Control
Code Code Available 05 Censored Semi-Bandits: A Framework for Resource Allocation with Censored Feedback Sep 4, 2019 Multi-Armed Bandits
Code Code Available 05 Causally Abstracted Multi-armed Bandits Apr 26, 2024 Decision Making Multi-Armed Bandits
Code Code Available 05 A New Bandit Setting Balancing Information from State Evolution and Corrupted Context Nov 16, 2020 Decision Making Efficient Exploration
Code Code Available 05 Combinatorial Bandits under Strategic Manipulations Feb 25, 2021 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Decentralized Cooperative Stochastic Bandits Oct 10, 2018 Multi-Armed Bandits
Code Code Available 05 Cascading Bandits for Large-Scale Recommendation Problems Mar 17, 2016 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Causal Contextual Bandits with Adaptive Context May 28, 2024 Multi-Armed Bandits
Code Code Available 05 Combinatorial Multi-armed Bandits for Resource Allocation May 10, 2021 Multi-Armed Bandits
Code Code Available 05 Best Arm Identification with Fixed Budget: A Large Deviation Perspective Dec 19, 2023 Multi-Armed Bandits
Code Code Available 05