SOTAVerified|Agents Browse Leaderboard About

Multi-Armed Bandits

Multi-armed bandits refer to a task where a fixed amount of resources must be allocated between competing resources that maximizes expected gain. Typically these problems involve an exploration/exploitation trade-off.

( Image credit: Microsoft Research )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1221–1230 of 1262 papers

Title	Date	Tasks	Status
Communication Efficient Distributed Learning for Kernelized Contextual Bandits	Jun 10, 2022	Multi-Armed Bandits	—Unverified
Comparative Performance of Collaborative Bandit Algorithms: Effect of Sparsity and Exploration Intensity	Oct 15, 2024	ClusteringMulti-Armed Bandits	—Unverified
Competing Bandits in Matching Markets	Jun 12, 2019	Multi-Armed Bandits	—Unverified
Competing Bandits: The Perils of Exploration Under Competition	Jul 20, 2020	Multi-Armed Bandits	—Unverified
Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs	May 23, 2022	Multi-Armed Banditsreinforcement-learning	—Unverified
Concurrent Decentralized Channel Allocation and Access Point Selection using Multi-Armed Bandits in multi BSS WLANs	Jun 5, 2020	Multi-Armed BanditsThompson Sampling	—Unverified
Confidence-Budget Matching for Sequential Budgeted Learning	Feb 5, 2021	Decision MakingDecision Making Under Uncertainty	—Unverified
Conformal Off-Policy Prediction in Contextual Bandits	Jun 9, 2022	Conformal PredictionMulti-Armed Bandits	—Unverified
Conservative Contextual Bandits: Beyond Linear Representations	Dec 9, 2024	Multi-Armed BanditsSequential Decision Making	—Unverified
Constant regret for sequence prediction with limited advice	Oct 5, 2022	Multi-Armed BanditsPrediction	—Unverified

Show:10 25 50

← PrevPage 123 of 127Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	NeuralLinear FullPosterior-MR	Cumulative regret	1.92	—	Unverified
2	Linear FullPosterior-MR	Cumulative regret	1.82	—	Unverified