SOTAVerified|Agents Browse Leaderboard About

Multi-Armed Bandits

Multi-armed bandits refer to a task where a fixed amount of resources must be allocated between competing resources that maximizes expected gain. Typically these problems involve an exploration/exploitation trade-off.

( Image credit: Microsoft Research )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 741–750 of 1262 papers

Title	Date	Tasks	Status
Optimal Learning for Sequential Decision Making for Expensive Cost Functions with Stochastic Binary Feedbacks	Sep 13, 2017	Decision MakingMulti-Armed Bandits	—Unverified
Towards Costless Model Selection in Contextual Bandits: A Bias-Variance Perspective	Jun 11, 2021	Model SelectionMulti-Armed Bandits	—Unverified
Optimal Multi-Objective Best Arm Identification with Fixed Confidence	Jan 23, 2025	Multi-Armed Bandits	—Unverified
Optimal No-regret Learning in Repeated First-price Auctions	Mar 22, 2020	Multi-Armed BanditsThompson Sampling	—Unverified
Optimal Rates of (Locally) Differentially Private Heavy-tailed Multi-Armed Bandits	Jun 4, 2021	Multi-Armed Bandits	—Unverified
Optimal Streaming Algorithms for Multi-Armed Bandits	Oct 23, 2024	Multi-Armed Bandits	—Unverified
Optimistic Information Directed Sampling	Feb 23, 2024	Multi-Armed Bandits	—Unverified
Optimism in the Face of Ambiguity Principle for Multi-Armed Bandits	Sep 30, 2024	Computational EfficiencyMulti-Armed Bandits	—Unverified
Optimizing Online Advertising with Multi-Armed Bandits: Mitigating the Cold Start Problem under Auction Dynamics	Feb 3, 2025	Multi-Armed Bandits	—Unverified
Optimizing Sharpe Ratio: Risk-Adjusted Decision-Making in Multi-Armed Bandits	May 28, 2024	Decision MakingManagement	—Unverified

Show:10 25 50

← PrevPage 75 of 127Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	NeuralLinear FullPosterior-MR	Cumulative regret	1.92	—	Unverified
2	Linear FullPosterior-MR	Cumulative regret	1.82	—	Unverified