SOTAVerified

SMAC

Bechmarks for Efficient Exploration of Completion of Multi-stage Tasks and Usage of Environmental Factors

Papers

Showing 1–50 of 121 papers

TitleStatusHype
Generalizable Agent Modeling for Agent Collaboration-Competition Adaptation with Multi-Retrieval and Dynamic GenerationCode0
Curriculum Learning With Counterfactual Group Relative Policy Advantage For Multi-Agent Reinforcement LearningCode1
Ensemble-MIX: Enhancing Sample Efficiency in Multi-Agent RL Using Ensemble Methods—0
Dynamic Sight Range Selection in Multi-Agent Reinforcement Learning—0
POCAII: Parameter Optimization with Conscious Allocation using Iterative Intelligence—0
JaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesCode1
Rainbow Delay Compensation: A Multi-Agent Reinforcement Learning Framework for Mitigating Delayed Observation—0
Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent CooperationCode0
AVA: Attentive VLM Agent for Mastering StarCraft IICode1
Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning—0
An Extended Benchmarking of Multi-Agent Reinforcement Learning Algorithms in Complex Fully Cooperative TasksCode1
Dual Ensembled Multiagent Q-Learning with Hypernet RegularizerCode0
O-MAPL: Offline Multi-agent Preference Learning—0
BLAST: A Stealthy Backdoor Leverage Attack against Cooperative Multi-Agent Deep Reinforcement Learning based Systems—0
SMAC-Hard: Enabling Mixed Opponent Strategy Script and Self-play on SMACCode1
LLM-PySC2: Starcraft II learning environment for Large Language ModelsCode2
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration—0
A New Approach to Solving SMAC Task: Generating Decision Tree Code from Large Language ModelsCode2
A Safety Modulator Actor-Critic Method in Model-Free Safe Reinforcement Learning and Application in UAV Hovering—0
Choices are More Important than Efforts: LLM Enables Efficient Multi-Agent ExplorationCode4
A Spatiotemporal Stealthy Backdoor Attack against Cooperative Multi-Agent Deep Reinforcement Learning—0
Diffusion-based Episodes Augmentation for Offline Multi-Agent Reinforcement Learning—0
Improving Global Parameter-sharing in Physically Heterogeneous Multi-agent Reinforcement Learning with Unified Action Space—0
QTypeMix: Enhancing Multi-Agent Cooperative Strategies through Heterogeneous and Homogeneous Value DecompositionCode0
CuDA2: An approach for Incorporating Traitor Agents into Cooperative Multi-Agent Systems—0
Decentralized Transformers with Centralized Aggregation are Sample-Efficient Multi-Agent World ModelsCode0
Soft-QMIX: Integrating Maximum Entropy For Monotonic Value Function FactorizationCode1
Individual Contributions as Intrinsic Exploration Scaffolds for Multi-agent Reinforcement LearningCode1
Efficient Multi-agent Reinforcement Learning by PlanningCode1
Higher Replay Ratio Empowers Sample-Efficient Multi-Agent Reinforcement Learning—0
Heterogeneous Multi-Agent Reinforcement Learning for Zero-Shot Scalable Collaboration—0
Better Understandings and Configurations in MaxSAT Local Search Solvers via Anytime Performance Analysis—0
PPS-QMIX: Periodically Parameter Sharing for Accelerating Convergence of Multi-Agent Reinforcement LearningCode0
Imagine, Initialize, and Explore: An Effective Exploration Method in Multi-Agent Reinforcement Learning—0
Aligning Individual and Collective Objectives in Multi-Agent Cooperation—0
Enabling Multi-Agent Transfer Reinforcement Learning via Scenario Independent Representation—0
MAIDCRL: Semi-centralized Multi-Agent Influence Dense-CNN Reinforcement Learning—0
Poisson Process for Bayesian Optimization—0
T2MAC: Targeted and Trusted Multi-Agent Communication through Selective Engagement and Evidence-Driven Integration—0
AgentMixer: Multi-Agent Correlated Policy Factorization—0
Innate-Values-driven Reinforcement Learning based Cooperative Multi-Agent Cognitive Modeling—0
How much can change in a year? Revisiting Evaluation in Multi-Agent Reinforcement Learning—0
QFree: A Universal Value Function Factorization for Multi-Agent Reinforcement Learning—0
MaskMA: Towards Zero-Shot Multi-Agent Decision Making with Mask-Based Collaborative Learning—0
Privacy-Engineered Value Decomposition Networks for Cooperative Multi-Agent Reinforcement Learning—0
FoX: Formation-aware exploration in multi-agent reinforcement learningCode1
HomOpt: A Homotopy-Based Hyperparameter Optimization MethodCode1
A Unified Framework for Factorizing Distributional Value Functions for Multi-Agent Reinforcement LearningCode0
Research on Multi-Agent Communication and Collaborative Decision-Making Based on Deep Reinforcement Learning—0
Robust multi-agent coordination via evolutionary generation of auxiliary adversarial attackersCode1
Show:102550
← PrevPage 1 of 3Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate97.22—Unverified
3QPLEXMedian Win Rate96.88—Unverified
4DPLEXMedian Win Rate96.88—Unverified
5DMIXMedian Win Rate95.11—Unverified
6QMIXMedian Win Rate92.44—Unverified
7VDNMedian Win Rate89.2—Unverified
8DIQLMedian Win Rate85.23—Unverified
9QMIXMedian Win Rate69—Unverified
10QMIXMedian Win Rate69—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate94.03—Unverified
3DMIXMedian Win Rate91.08—Unverified
4DPLEXMedian Win Rate90.62—Unverified
5VDNMedian Win Rate89.2—Unverified
6QPLEXMedian Win Rate84.38—Unverified
7QMIXMedian Win Rate67.22—Unverified
8DIQLMedian Win Rate62.22—Unverified
9IQLMedian Win Rate29.83—Unverified
10VDNMedian Win Rate2—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate100—Unverified
2DDNMedian Win Rate95.4—Unverified
3DIQLMedian Win Rate91.62—Unverified
4DMIXMedian Win Rate90.45—Unverified
5VDNMedian Win Rate85.34—Unverified
6IQLMedian Win Rate84.87—Unverified
7DPLEXMedian Win Rate81.25—Unverified
8QPLEXMedian Win Rate75—Unverified
9QMIXMedian Win Rate37.61—Unverified
10QMIXMedian Win Rate1—Unverified
#ModelMetricClaimedVerifiedStatus
1ACEMedian Win Rate93.75—Unverified
2DDNMedian Win Rate83.92—Unverified
3DMIXMedian Win Rate49.43—Unverified
4DPLEXMedian Win Rate43.75—Unverified
5QPLEXAverage Score15.95—Unverified
6QMIXMedian Win Rate12.78—Unverified
7QMIXMedian Win Rate3—Unverified
8QMIXMedian Win Rate3—Unverified
9DIQLMedian Win Rate0—Unverified
10IQLMedian Win Rate0—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNMedian Win Rate91.48—Unverified
2DPLEXMedian Win Rate90.62—Unverified
3DMIXMedian Win Rate85.45—Unverified
4QMIXMedian Win Rate84.77—Unverified
5QPLEXMedian Win Rate78.12—Unverified
6VDNMedian Win Rate63.12—Unverified
7QMIXMedian Win Rate49—Unverified
8QMIXMedian Win Rate49—Unverified
9DIQLMedian Win Rate6.02—Unverified
10IQLMedian Win Rate2.27—Unverified
#ModelMetricClaimedVerifiedStatus
1DMIXAverage Score19.17—Unverified
2QPLEXAverage Score18.66—Unverified
3DPLEXAverage Score18.49—Unverified
4DDNAverage Score18.49—Unverified
5QMIXAverage Score18.23—Unverified
6VDNAverage Score16.69—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.65—Unverified
2DMIXAverage Score18.61—Unverified
3VDNAverage Score17.16—Unverified
4DPLEXAverage Score14.99—Unverified
5QPLEXAverage Score13.6—Unverified
6QMIXAverage Score13.09—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16—Unverified
2DPLEXAverage Score14.84—Unverified
3QPLEXAverage Score13.86—Unverified
4DMIXAverage Score13.73—Unverified
5VDNAverage Score13.57—Unverified
6QMIXAverage Score12.37—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score11.1—Unverified
2DPLEXAverage Score10.71—Unverified
3VDNAverage Score7.78—Unverified
4DMIXAverage Score7.41—Unverified
5QPLEXAverage Score6.44—Unverified
6QMIXAverage Score4.8—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score16.5—Unverified
2DMIXAverage Score16.24—Unverified
3DPLEXAverage Score15.89—Unverified
4QPLEXAverage Score15.52—Unverified
5QMIXAverage Score14.4—Unverified
6VDNAverage Score13.13—Unverified
#ModelMetricClaimedVerifiedStatus
1DDNAverage Score19.45—Unverified
2DPLEXAverage Score19.4—Unverified
3DMIXAverage Score19.33—Unverified
4QPLEXAverage Score19.06—Unverified
5QMIXAverage Score19.01—Unverified
6VDNAverage Score17.3—Unverified