SOTAVerified

SMAC

Bechmarks for Efficient Exploration of Completion of Multi-stage Tasks and Usage of Environmental Factors

Papers

Showing 1–25 of 121 papers

TitleStatusHype
Choices are More Important than Efforts: LLM Enables Efficient Multi-Agent ExplorationCode4
Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement LearningCode2
SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement LearningCode2
LLM-PySC2: Starcraft II learning environment for Large Language ModelsCode2
ACE: Cooperative Multi-agent Q-learning with Bidirectional Action-DependencyCode2
A New Approach to Solving SMAC Task: Generating Decision Tree Code from Large Language ModelsCode2
Robust multi-agent coordination via evolutionary generation of auxiliary adversarial attackersCode1
Latent State Marginalization as a Low-cost Approach for Improving ExplorationCode1
Scalable Multi-Agent Model-Based Reinforcement LearningCode1
Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement LearningCode1
Attacking Cooperative Multi-Agent Reinforcement Learning by Adversarial Minority InfluenceCode1
HomOpt: A Homotopy-Based Hyperparameter Optimization MethodCode1
Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?Code1
Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC TasksCode1
An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative TasksCode1
Efficient Multi-agent Reinforcement Learning by PlanningCode1
Deep Implicit Coordination Graphs for Multi-agent Reinforcement LearningCode1
DFAC Framework: Factorizing the Value Function via Quantile Mixture for Multi-Agent Distributional Q-LearningCode1
Graph Convolutional Value Decomposition in Multi-Agent Reinforcement LearningCode1
FACMAC: Factored Multi-Agent Centralised Policy GradientsCode1
Rethinking the Implementation Matters in Cooperative Multi-Agent Reinforcement LearningCode1
Contrastive Identity-Aware Learning for Multi-Agent Value DecompositionCode1
FoX: Formation-aware exploration in multi-agent reinforcement learningCode1
Curriculum Learning With Counterfactual Group Relative Policy Advantage For Multi-Agent Reinforcement LearningCode1
JaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesCode1
Show:102550
← PrevPage 1 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate97.22—Unverified
3QPLEXMedian Win Rate96.88—Unverified
4DPLEXMedian Win Rate96.88—Unverified
5DMIXMedian Win Rate95.11—Unverified
6QMIXMedian Win Rate92.44—Unverified
7VDNMedian Win Rate89.2—Unverified
8DIQLMedian Win Rate85.23—Unverified
9QMIXMedian Win Rate69—Unverified
10QMIXMedian Win Rate69—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate94.03—Unverified
3DMIXMedian Win Rate91.08—Unverified
4DPLEXMedian Win Rate90.62—Unverified
5VDNMedian Win Rate89.2—Unverified
6QPLEXMedian Win Rate84.38—Unverified
7QMIXMedian Win Rate67.22—Unverified
8DIQLMedian Win Rate62.22—Unverified
9IQLMedian Win Rate29.83—Unverified
10VDNMedian Win Rate2—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate95.4—Unverified
3DIQLMedian Win Rate91.62—Unverified
4DMIXMedian Win Rate90.45—Unverified
5VDNMedian Win Rate85.34—Unverified
6IQLMedian Win Rate84.87—Unverified
7DPLEXMedian Win Rate81.25—Unverified
8QPLEXMedian Win Rate75—Unverified
9QMIXMedian Win Rate37.61—Unverified
10QMIXMedian Win Rate1—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate93.75—Unverified
2DDNMedian Win Rate83.92—Unverified
3DMIXMedian Win Rate49.43—Unverified
4DPLEXMedian Win Rate43.75—Unverified
5QPLEXAverage Score15.95—Unverified
6QMIXMedian Win Rate12.78—Unverified
7QMIXMedian Win Rate3—Unverified
8QMIXMedian Win Rate3—Unverified
9DIQLMedian Win Rate0—Unverified
10IQLMedian Win Rate0—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNMedian Win Rate91.48—Unverified
2DPLEXMedian Win Rate90.62—Unverified
3DMIXMedian Win Rate85.45—Unverified
4QMIXMedian Win Rate84.77—Unverified
5QPLEXMedian Win Rate78.12—Unverified
6VDNMedian Win Rate63.12—Unverified
7QMIXMedian Win Rate49—Unverified
8QMIXMedian Win Rate49—Unverified
9DIQLMedian Win Rate6.02—Unverified
10IQLMedian Win Rate2.27—Unverified
#ModelMetricClaimedVerifiedStatus
1DMIXAverage Score19.17—Unverified
2QPLEXAverage Score18.66—Unverified
3DPLEXAverage Score18.49—Unverified
4DDNAverage Score18.49—Unverified
5QMIXAverage Score18.23—Unverified
6VDNAverage Score16.69—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.65—Unverified
2DMIXAverage Score18.61—Unverified
3VDNAverage Score17.16—Unverified
4DPLEXAverage Score14.99—Unverified
5QPLEXAverage Score13.6—Unverified
6QMIXAverage Score13.09—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16—Unverified
2DPLEXAverage Score14.84—Unverified
3QPLEXAverage Score13.86—Unverified
4DMIXAverage Score13.73—Unverified
5VDNAverage Score13.57—Unverified
6QMIXAverage Score12.37—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score11.1—Unverified
2DPLEXAverage Score10.71—Unverified
3VDNAverage Score7.78—Unverified
4DMIXAverage Score7.41—Unverified
5QPLEXAverage Score6.44—Unverified
6QMIXAverage Score4.8—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16.5—Unverified
2DMIXAverage Score16.24—Unverified
3DPLEXAverage Score15.89—Unverified
4QPLEXAverage Score15.52—Unverified
5QMIXAverage Score14.4—Unverified
6VDNAverage Score13.13—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.45—Unverified
2DPLEXAverage Score19.4—Unverified
3DMIXAverage Score19.33—Unverified
4QPLEXAverage Score19.06—Unverified
5QMIXAverage Score19.01—Unverified
6VDNAverage Score17.3—Unverified