SOTAVerified|Agents Browse Leaderboard About

Multi-Armed Bandits

Multi-armed bandits refer to a task where a fixed amount of resources must be allocated between competing resources that maximizes expected gain. Typically these problems involve an exploration/exploitation trade-off.

( Image credit: Microsoft Research )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 131–140 of 1262 papers

Title	Date	Tasks	Status
Contextual Bandits with Arm Request Costs and Delays	Oct 17, 2024	Movie RecommendationMulti-Armed Bandits	—Unverified
Online Learning for Function Placement in Serverless Computing	Oct 17, 2024	Multi-Armed Bandits	CodeCode Available
Is Prior-Free Black-Box Non-Stationary Reinforcement Learning Feasible?	Oct 17, 2024	Change DetectionMulti-Armed Bandits	—Unverified
How Does Variance Shape the Regret in Contextual Bandits?	Oct 16, 2024	Multi-Armed Bandits	—Unverified
Comparative Performance of Collaborative Bandit Algorithms: Effect of Sparsity and Exploration Intensity	Oct 15, 2024	ClusteringMulti-Armed Bandits	—Unverified
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing	Oct 14, 2024	Multi-Armed Banditsparameter estimation	—Unverified
Diminishing Exploration: A Minimalist Approach to Piecewise Stationary Multi-Armed Bandits	Oct 8, 2024	Change DetectionMulti-Armed Bandits	—Unverified
EVOLvE: Evaluating and Optimizing LLMs For Exploration	Oct 8, 2024	Decision Making Under UncertaintyMulti-Armed Bandits	—Unverified
Contextual Bandits with Non-Stationary Correlated Rewards for User Association in MmWave Vehicular Networks	Oct 8, 2024	Multi-Armed BanditsThompson Sampling	—Unverified
Stochastic Bandits for Egalitarian Assignment	Oct 8, 2024	FairnessMulti-Armed Bandits	—Unverified

Show:10 25 50

← PrevPage 14 of 127Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	NeuralLinear FullPosterior-MR	Cumulative regret	1.92	—	Unverified
2	Linear FullPosterior-MR	Cumulative regret	1.82	—	Unverified