SOTAVerified

SMAC

Bechmarks for Efficient Exploration of Completion of Multi-stage Tasks and Usage of Environmental Factors

Papers

Showing 1–50 of 121 papers

TitleStatusHype
Choices are More Important than Efforts: LLM Enables Efficient Multi-Agent ExplorationCode4
Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement LearningCode2
SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement LearningCode2
A New Approach to Solving SMAC Task: Generating Decision Tree Code from Large Language ModelsCode2
ACE: Cooperative Multi-agent Q-learning with Bidirectional Action-DependencyCode2
LLM-PySC2: Starcraft II learning environment for Large Language ModelsCode2
Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?Code1
Efficient Multi-agent Reinforcement Learning by PlanningCode1
SHAQ: Incorporating Shapley Value Theory into Multi-Agent Q-LearningCode1
Attacking Cooperative Multi-Agent Reinforcement Learning by Adversarial Minority InfluenceCode1
JaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesCode1
SMAC-Hard: Enabling Mixed Opponent Strategy Script and Self-play on SMACCode1
Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement LearningCode1
Robust multi-agent coordination via evolutionary generation of auxiliary adversarial attackersCode1
AVA: Attentive VLM Agent for Mastering StarCraft IICode1
Graph Convolutional Value Decomposition in Multi-Agent Reinforcement LearningCode1
SMAClite: A Lightweight Environment for Multi-Agent Reinforcement LearningCode1
An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative TasksCode1
The StarCraft Multi-Agent ChallengeCode1
UPDeT: Universal Multi-agent Reinforcement Learning via Policy Decoupling with TransformersCode1
Contrastive Identity-Aware Learning for Multi-Agent Value DecompositionCode1
FoX: Formation-aware exploration in multi-agent reinforcement learningCode1
Scalable Multi-Agent Model-Based Reinforcement LearningCode1
Latent State Marginalization as a Low-cost Approach for Improving ExplorationCode1
Rethinking the Implementation Matters in Cooperative Multi-Agent Reinforcement LearningCode1
Curriculum Learning With Counterfactual Group Relative Policy Advantage For Multi-Agent Reinforcement LearningCode1
DFAC Framework: Factorizing the Value Function via Quantile Mixture for Multi-Agent Distributional Q-LearningCode1
HomOpt: A Homotopy-Based Hyperparameter Optimization MethodCode1
Deep Implicit Coordination Graphs for Multi-agent Reinforcement LearningCode1
FACMAC: Factored Multi-Agent Centralised Policy GradientsCode1
Offline Pre-trained Multi-Agent Decision Transformer: One Big Sequence Model Tackles All SMAC TasksCode1
Soft-QMIX: Integrating Maximum Entropy For Monotonic Value Function FactorizationCode1
Transformer-based Value Function Decomposition for Cooperative Multi-agent Reinforcement Learning in StarCraftCode1
Automated classification of pre-defined movement patterns: A comparison between GNSS and UWB technology—0
Innate-Values-driven Reinforcement Learning based Cooperative Multi-Agent Cognitive Modeling—0
CuDA2: An approach for Incorporating Traitor Agents into Cooperative Multi-Agent Systems—0
Aligning Individual and Collective Objectives in Multi-Agent Cooperation—0
Coordinated Multi-Agent Exploration Using Shared Goals—0
Cooperative Exploration for Multi-Agent Deep Reinforcement Learning—0
A Comparative study of Hyper-Parameter Optimization Tools—0
Improving Global Parameter-sharing in Physically Heterogeneous Multi-agent Reinforcement Learning with Unified Action Space—0
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning—0
Fast Optimization of Wildfire Suppression Policies with SMAC—0
Exploiting Semantic Epsilon Greedy Exploration Strategy in Multi-Agent Reinforcement Learning—0
Contextual Transformer for Offline Meta Reinforcement Learning—0
How much can change in a year? Revisiting Evaluation in Multi-Agent Reinforcement Learning—0
Ensemble-MIX: Enhancing Sample Efficiency in Multi-Agent RL Using Ensemble Methods—0
Enabling Multi-Agent Transfer Reinforcement Learning via Scenario Independent Representation—0
Heterogeneous Multi-Agent Reinforcement Learning for Zero-Shot Scalable Collaboration—0
Characterization of neighborhood behaviours in a multi-neighborhood local search algorithm—0
Show:102550
← PrevPage 1 of 3Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate97.22—Unverified
3QPLEXMedian Win Rate96.88—Unverified
4DPLEXMedian Win Rate96.88—Unverified
5DMIXMedian Win Rate95.11—Unverified
6QMIXMedian Win Rate92.44—Unverified
7VDNMedian Win Rate89.2—Unverified
8DIQLMedian Win Rate85.23—Unverified
9QMIXMedian Win Rate69—Unverified
10QMIXMedian Win Rate69—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate94.03—Unverified
3DMIXMedian Win Rate91.08—Unverified
4DPLEXMedian Win Rate90.62—Unverified
5VDNMedian Win Rate89.2—Unverified
6QPLEXMedian Win Rate84.38—Unverified
7QMIXMedian Win Rate67.22—Unverified
8DIQLMedian Win Rate62.22—Unverified
9IQLMedian Win Rate29.83—Unverified
10VDNMedian Win Rate2—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate95.4—Unverified
3DIQLMedian Win Rate91.62—Unverified
4DMIXMedian Win Rate90.45—Unverified
5VDNMedian Win Rate85.34—Unverified
6IQLMedian Win Rate84.87—Unverified
7DPLEXMedian Win Rate81.25—Unverified
8QPLEXMedian Win Rate75—Unverified
9QMIXMedian Win Rate37.61—Unverified
10QMIXMedian Win Rate1—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate93.75—Unverified
2DDNMedian Win Rate83.92—Unverified
3DMIXMedian Win Rate49.43—Unverified
4DPLEXMedian Win Rate43.75—Unverified
5QPLEXAverage Score15.95—Unverified
6QMIXMedian Win Rate12.78—Unverified
7QMIXMedian Win Rate3—Unverified
8QMIXMedian Win Rate3—Unverified
9DIQLMedian Win Rate0—Unverified
10IQLMedian Win Rate0—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNMedian Win Rate91.48—Unverified
2DPLEXMedian Win Rate90.62—Unverified
3DMIXMedian Win Rate85.45—Unverified
4QMIXMedian Win Rate84.77—Unverified
5QPLEXMedian Win Rate78.12—Unverified
6VDNMedian Win Rate63.12—Unverified
7QMIXMedian Win Rate49—Unverified
8QMIXMedian Win Rate49—Unverified
9DIQLMedian Win Rate6.02—Unverified
10IQLMedian Win Rate2.27—Unverified
#ModelMetricClaimedVerifiedStatus
1DMIXAverage Score19.17—Unverified
2QPLEXAverage Score18.66—Unverified
3DPLEXAverage Score18.49—Unverified
4DDNAverage Score18.49—Unverified
5QMIXAverage Score18.23—Unverified
6VDNAverage Score16.69—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.65—Unverified
2DMIXAverage Score18.61—Unverified
3VDNAverage Score17.16—Unverified
4DPLEXAverage Score14.99—Unverified
5QPLEXAverage Score13.6—Unverified
6QMIXAverage Score13.09—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16—Unverified
2DPLEXAverage Score14.84—Unverified
3QPLEXAverage Score13.86—Unverified
4DMIXAverage Score13.73—Unverified
5VDNAverage Score13.57—Unverified
6QMIXAverage Score12.37—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score11.1—Unverified
2DPLEXAverage Score10.71—Unverified
3VDNAverage Score7.78—Unverified
4DMIXAverage Score7.41—Unverified
5QPLEXAverage Score6.44—Unverified
6QMIXAverage Score4.8—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16.5—Unverified
2DMIXAverage Score16.24—Unverified
3DPLEXAverage Score15.89—Unverified
4QPLEXAverage Score15.52—Unverified
5QMIXAverage Score14.4—Unverified
6VDNAverage Score13.13—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.45—Unverified
2DPLEXAverage Score19.4—Unverified
3DMIXAverage Score19.33—Unverified
4QPLEXAverage Score19.06—Unverified
5QMIXAverage Score19.01—Unverified
6VDNAverage Score17.3—Unverified