Confidence Intervals for Policy Evaluation in Adaptive Experiments Nov 7, 2019 Experimental Design Multi-Armed Bandits
Code Code Available 05 On-line Adaptative Curriculum Learning for GANs Jul 31, 2018 Multi-Armed Bandits Stochastic Optimization
Code Code Available 05 Online Matching: A Real-time Bandit System for Large-scale Recommendations Jul 29, 2023 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Online Semi-Supervised Learning in Contextual Bandits with Episodic Reward Sep 17, 2020 Clustering Decision Making
Code Code Available 05 The Unreasonable Effectiveness of Greedy Algorithms in Multi-Armed Bandit with Many Arms Feb 24, 2020 Multi-Armed Bandits
Code Code Available 05 Optimal Baseline Corrections for Off-Policy Contextual Bandits May 9, 2024 Decision Making Multi-Armed Bandits
Code Code Available 05 Optimal Regret Is Achievable with Bounded Approximate Inference Error: An Enhanced Bayesian Upper Confidence Bound Framework Jan 31, 2022 Bayesian Inference Multi-Armed Bandits
Code Code Available 05 Budgeted Multi-Armed Bandits with Asymmetric Confidence Intervals Jun 12, 2023 Multi-Armed Bandits
Code Code Available 05 Optimistic Whittle Index Policy: Online Learning for Restless Bandits May 30, 2022 Multi-Armed Bandits
Code Code Available 05 Output-Weighted Sampling for Multi-Armed Bandits with Extreme Payoffs Feb 19, 2021 Decision Making Gaussian Processes
Code Code Available 05 Constrained regret minimization for multi-criterion multi-armed bandits Jun 17, 2020 Attribute Multi-Armed Bandits
Code Code Available 05 Performance-Aware Self-Configurable Multi-Agent Networks: A Distributed Submodular Approach for Simultaneous Coordination and Network Design Sep 2, 2024 Event Detection Multi-Armed Bandits
Code Code Available 05 Model selection for contextual bandits Jun 3, 2019 model Model Selection
Code Code Available 05 Conditionally Risk-Averse Contextual Bandits Oct 24, 2022 Management Multi-Armed Bandits
Code Code Available 05 Cascading Bandits for Large-Scale Recommendation Problems Mar 17, 2016 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Power Constrained Bandits Apr 13, 2020 Decision Making Multi-Armed Bandits
Code Code Available 05 Practical Calculation of Gittins Indices for Multi-armed Bandits Sep 11, 2019 Multi-Armed Bandits
Code Code Available 05 Causal Contextual Bandits with Adaptive Context May 28, 2024 Multi-Armed Bandits
Code Code Available 05 Addressing the Long-term Impact of ML Decisions via Policy Regret Jun 2, 2021 Multi-Armed Bandits
Code Code Available 05 Quantile Bandits for Best Arms Identification Oct 22, 2020 Decision Making Multi-Armed Bandits
Code Code Available 05 Causally Abstracted Multi-armed Bandits Apr 26, 2024 Decision Making Multi-Armed Bandits
Code Code Available 05 Censored Semi-Bandits: A Framework for Resource Allocation with Censored Feedback Sep 4, 2019 Multi-Armed Bandits
Code Code Available 05 Contextual bandits with entropy-based human feedback Feb 12, 2025 Multi-Armed Bandits
Code Code Available 05 Regulating Greed Over Time in Multi-Armed Bandits May 21, 2015 Multi-Armed Bandits Time Series Analysis
Code Code Available 05 Relational Boosted Bandits Dec 16, 2020 Attribute Descriptive
Code Code Available 05 Residual Loss Prediction: Reinforcement Learning With No Incremental Feedback Jan 1, 2018 Multi-Armed Bandits Prediction
Code Code Available 05 Semiparametric Contextual Bandits Mar 12, 2018 Multi-Armed Bandits
Code Code Available 05 Sequential Decision Making with Expert Demonstrations under Unobserved Heterogeneity Apr 10, 2024 Decision Making Meta Reinforcement Learning
Code Code Available 05 SIC-MMAB: Synchronisation Involves Communication in Multiplayer Multi-Armed Bandits Sep 21, 2018 Multi-Armed Bandits
Code Code Available 05 Simulated Contextual Bandits for Personalization Tasks from Recommendation Datasets Oct 12, 2022 Benchmarking Multi-Armed Bandits
Code Code Available 05 Approximating a Target Distribution using Weight Queries Jun 24, 2020 Domain Adaptation Multi-Armed Bandits
Code Code Available 05 Combinatorial Bandits under Strategic Manipulations Feb 25, 2021 Multi-Armed Bandits Recommendation Systems
Code Code Available 05 Cost-Efficient Online Decision Making: A Combinatorial Multi-Armed Bandit Approach Aug 21, 2023 Decision Making Multi-Armed Bandits
Code Code Available 05 Stochastic Rising Bandits Dec 7, 2022 Model Selection Multi-Armed Bandits
Code Code Available 05 Adversarial Attacks on Combinatorial Multi-Armed Bandits Oct 8, 2023 Multi-Armed Bandits
Code Code Available 05 Combinatorial Multi-armed Bandits for Resource Allocation May 10, 2021 Multi-Armed Bandits
Code Code Available 05 The Assistive Multi-Armed Bandit Jan 24, 2019 Multi-Armed Bandits
Code Code Available 05 Thompson Sampling for Bandit Learning in Matching Markets Apr 26, 2022 Multi-Armed Bandits Thompson Sampling
Code Code Available 05 Stay With Me: Lifetime Maximization Through Heteroscedastic Linear Bandits With Reneging Oct 29, 2018 Decision Making Multi-Armed Bandits
Code Code Available 05 Thompson Sampling via Local Uncertainty Oct 30, 2019 Decision Making Multi-Armed Bandits
Code Code Available 05 Top-k eXtreme Contextual Bandits with Arm Hierarchy Feb 15, 2021 Computational Efficiency Extreme Multi-Label Classification
Code Code Available 05 Towards the D-Optimal Online Experiment Design for Recommender Selection Oct 23, 2021 Multi-Armed Bandits
Code Code Available 05 Networked Restless Bandits with Positive Externalities Dec 9, 2022 Multi-Armed Bandits
Code Code Available 05 Two-Stage Neural Contextual Bandits for Personalised News Recommendation Jun 26, 2022 Computational Efficiency Multi-Armed Bandits
Code Code Available 05 Asymptotically Best Causal Effect Identification with Multi-Armed Bandits Dec 1, 2021 Multi-Armed Bandits
— Unverified 00 Adversarial Contextual Bandits Go Kernelized Oct 2, 2023 Decision Making Multi-Armed Bandits
— Unverified 00 Comparative Performance of Collaborative Bandit Algorithms: Effect of Sparsity and Exploration Intensity Oct 15, 2024 Clustering Multi-Armed Bandits
— Unverified 00 A Survey of Risk-Aware Multi-Armed Bandits May 12, 2022 Multi-Armed Bandits Portfolio Optimization
— Unverified 00 Communication Efficient Distributed Learning for Kernelized Contextual Bandits Jun 10, 2022 Multi-Armed Bandits
— Unverified 00 Adversarial Bandits with Knapsacks Nov 28, 2018 Multi-Armed Bandits Scheduling
— Unverified 00