SOTAVerified

Bias Detection

Bias detection is the task of detecting and measuring racism, sexism and otherwise discriminatory behavior in a model (Source: https://stereoset.mit.edu/)

Papers

Showing 121–130 of 199 papers

TitleStatusHype
Bipol: Multi-axes Evaluation of Bias with Explainability in Benchmark DatasetsCode0
Auditing Algorithmic Fairness in Machine Learning for Health with Severity-Based LOGAN—0
Mind Your Bias: A Critical Review of Bias Detection Methods for Contextual Language ModelsCode0
Exploiting Transformer-based Multitask Learning for the Detection of Media Bias in News Articles—0
A Keyword Based Approach to Understanding the Overpenalization of Marginalized Groups by English Marginal Abuse Models on Twitter—0
Efficient Gender Debiasing of Pre-trained Indic Language Models—0
A Unified Comparison of User Modeling Techniques for Predicting Data Interaction and Detecting Exploration BiasCode0
Robots Enact Malignant Stereotypes—0
MRCLens: an MRC Dataset Bias Detection Toolkit—0
A methodology to characterize bias and harmful stereotypes in natural language processing in Latin AmericaCode0
Show:102550
← PrevPage 13 of 20Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GPT-2 (small)ICAT Score72.97—Unverified
2XLNet (large)ICAT Score72.03—Unverified
3GPT-2 (medium)ICAT Score71.73—Unverified
4BERT (base)ICAT Score71.21—Unverified
5GPT-2 (large)ICAT Score70.54—Unverified
6BERT (large)ICAT Score69.89—Unverified
7RoBERTa (base)ICAT Score67.5—Unverified
8GAL 120BICAT Score65.6—Unverified
9XLNet (base)ICAT Score62.1—Unverified
10GPT-3 (text-davinci-002)ICAT Score60.8—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT-4Best-of0.5—Unverified
2BaselineBest-of0.41—Unverified
3GemmaBest-of0.41—Unverified
4MistralBest-of0.36—Unverified
5Llama2Best-of0.34—Unverified
#ModelMetricClaimedVerifiedStatus
1BADICAT Score23.44—Unverified
#ModelMetricClaimedVerifiedStatus
1RandomForest_default_hyperparametersAccuracy (%)49—Unverified
#ModelMetricClaimedVerifiedStatus
1RoBERTa+ALBERTF170.4—Unverified