SOTAVerified|Agents Browse Leaderboard About

Multi-Armed Bandits

Multi-armed bandits refer to a task where a fixed amount of resources must be allocated between competing resources that maximizes expected gain. Typically these problems involve an exploration/exploitation trade-off.

( Image credit: Microsoft Research )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 431–440 of 1262 papers

Title	Date	Tasks	Status
Stochastic Contextual Bandits with Long Horizon Rewards	Feb 2, 2023	Decision MakingLanguage Modeling	—Unverified
Randomized Greedy Learning for Non-monotone Stochastic Submodular Maximization Under Full-bandit Feedback	Feb 2, 2023	Multi-Armed Bandits	—Unverified
Improved Algorithms for Multi-period Multi-class Packing Problems with Bandit Feedback	Jan 31, 2023	ManagementMulti-Armed Bandits	—Unverified
Quantum contextual bandits and recommender systems for quantum data	Jan 31, 2023	Multi-Armed BanditsRecommendation Systems	—Unverified
Adversarial Attacks on Adversarial Bandits	Jan 30, 2023	Multi-Armed BanditsRecommendation Systems	—Unverified
A Framework for Adapting Offline Algorithms to Solve Combinatorial Multi-Armed Bandit Problems with Bandit Feedback	Jan 30, 2023	Multi-Armed Bandits	—Unverified
Contextual Causal Bayesian Optimisation	Jan 29, 2023	Bayesian OptimisationMulti-Armed Bandits	—Unverified
Communication-Efficient Collaborative Regret Minimization in Multi-Armed Bandits	Jan 26, 2023	Multi-agent Reinforcement LearningMulti-Armed Bandits	—Unverified
Banker Online Mirror Descent: A Universal Approach for Delayed Online Bandit Learning	Jan 25, 2023	Multi-Armed Bandits	—Unverified
Quantum Heavy-tailed Bandits	Jan 23, 2023	Multi-Armed Bandits	—Unverified

Show:10 25 50

← PrevPage 44 of 127Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	NeuralLinear FullPosterior-MR	Cumulative regret	1.92	—	Unverified
2	Linear FullPosterior-MR	Cumulative regret	1.82	—	Unverified