SOTAVerified|Agents Browse Leaderboard About

Multi-Armed Bandits

Multi-armed bandits refer to a task where a fixed amount of resources must be allocated between competing resources that maximizes expected gain. Typically these problems involve an exploration/exploitation trade-off.

( Image credit: Microsoft Research )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 471–480 of 1262 papers

Title	Date	Tasks	Status
Adaptive Exploration in Linear Contextual Bandit	Oct 15, 2019	Decision MakingMulti-Armed Bandits	—Unverified
Active Inference for Autonomous Decision-Making with Contextual Multi-Armed Bandits	Sep 19, 2022	Decision MakingDecision Making Under Uncertainty	—Unverified
Accurate and Fast Federated Learning via Combinatorial Multi-Armed Bandits	Dec 6, 2020	BIG-bench Machine LearningFederated Learning	—Unverified
Deep Contextual Multi-armed Bandits	Jul 25, 2018	MarketingMulti-Armed Bandits	—Unverified
Falsification of Multiple Requirements for Cyber-Physical Systems Using Online Generative Adversarial Networks and Multi-Armed Bandits	May 23, 2022	Multi-Armed Bandits	—Unverified
Fast and Sample Efficient Multi-Task Representation Learning in Stochastic Contextual Bandits	Oct 2, 2024	Multi-Armed BanditsMulti-Task Learning	—Unverified
Deep Contextual Bandits for Fast Neighbor-Aided Initial Access in mmWave Cell-Free Networks	Mar 17, 2021	Multi-Armed Bandits	—Unverified
Faster Maximum Inner Product Search in High Dimensions	Dec 14, 2022	Multi-Armed BanditsRecommendation Systems	—Unverified
Towards Bayesian Data Selection	Jun 18, 2024	Active LearningAdditive models	—Unverified
Batch Ensemble for Variance Dependent Regret in Stochastic Bandits	Sep 13, 2024	Multi-Armed BanditsReinforcement Learning (RL)	—Unverified

Show:10 25 50

← PrevPage 48 of 127Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	NeuralLinear FullPosterior-MR	Cumulative regret	1.92	—	Unverified
2	Linear FullPosterior-MR	Cumulative regret	1.82	—	Unverified