SOTAVerified

Adversarial Robustness

Adversarial Robustness evaluates the vulnerabilities of machine learning models under various types of adversarial attacks.

Papers

Showing 1–10 of 1746 papers

TitleStatusHype
Bridging Robustness and Generalization Against Word Substitution Attacks in NLP via the Growth Bound Matrix ApproachCode0
Tail-aware Adversarial Attacks: A Distributional Approach to Efficient LLM Jailbreaking—0
Rectifying Adversarial Sample with Low Entropy Prior for Test-Time Defense—0
Evaluating the Evaluators: Trust in Adversarial Robustness Tests—0
Is Reasoning All You Need? Probing Bias in the Age of Reasoning Language Models—0
NIC-RobustBench: A Comprehensive Open-Source Toolkit for Neural Image Compression and Robustness AnalysisCode1
PRISON: Unmasking the Criminal Potential of Large Language Models—0
Intriguing Frequency Interpretation of Adversarial Robustness for CNNs and ViTs—0
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models—0
Canonical Latent Representations in Conditional Diffusion Models—0
Show:102550
← PrevPage 1 of 175Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1DeBERTa (single model)Accuracy0.61—Unverified
2ALBERT (single model)Accuracy0.59—Unverified
3T5 (single model)Accuracy0.57—Unverified
4SMART_RoBERTa (single model)Accuracy0.54—Unverified
5FreeLB (single model)Accuracy0.5—Unverified
6RoBERTa (single model)Accuracy0.5—Unverified
7InfoBERT (single model)Accuracy0.46—Unverified
8ELECTRA (single model)Accuracy0.42—Unverified
9BERT (single model)Accuracy0.34—Unverified
10SMART_BERT (single model)Accuracy0.3—Unverified
#ModelMetricClaimedVerifiedStatus
1Mixed classifierAccuracy95.23—Unverified
2Stochastic-LWTA/PGD/WideResNet-34-10Accuracy92.26—Unverified
3Stochastic-LWTA/PGD/WideResNet-34-5Accuracy91.88—Unverified
4GLOT-DRAccuracy84.13—Unverified
5TRADES-ANCRA/ResNet18Accuracy81.7—Unverified
#ModelMetricClaimedVerifiedStatus
1ResNet-50 (SGD, Cosine)Accuracy77.4—Unverified
2ResNet-50 (SGD, Step)Accuracy76.9—Unverified
3DeiT-S (AdamW, Cosine)Accuracy76.8—Unverified
4ResNet-50 (AdamW, Cosine)Accuracy76.4—Unverified
#ModelMetricClaimedVerifiedStatus
1DeiT-S (AdamW, Cosine)Accuracy12.2—Unverified
2ResNet-50 (SGD, Cosine)Accuracy3.3—Unverified
3ResNet-50 (SGD, Step)Accuracy3.2—Unverified
4ResNet-50 (AdamW, Cosine)Accuracy3.1—Unverified
#ModelMetricClaimedVerifiedStatus
1ResNet-50 (AdamW, Cosine)mean Corruption Error (mCE)59.3—Unverified
2ResNet-50 (SGD, Step)mean Corruption Error (mCE)57.9—Unverified
3ResNet-50 (SGD, Cosine)mean Corruption Error (mCE)56.9—Unverified
4DeiT-S (AdamW, Cosine)mean Corruption Error (mCE)48—Unverified
#ModelMetricClaimedVerifiedStatus
1DeiT-S (AdamW, Cosine)Accuracy13—Unverified
2ResNet-50 (SGD, Cosine)Accuracy8.4—Unverified
3ResNet-50 (SGD, Step)Accuracy8.3—Unverified
4ResNet-50 (AdamW, Cosine)Accuracy8.1—Unverified
#ModelMetricClaimedVerifiedStatus
1Mixed ClassifierClean Accuracy85.21—Unverified
2ResNet18/MART-ANCRAClean Accuracy60.1—Unverified