SOTAVerified

Bias Detection

Bias detection is the task of detecting and measuring racism, sexism and otherwise discriminatory behavior in a model (Source: https://stereoset.mit.edu/)

Papers

Showing 51–100 of 199 papers

TitleStatusHype
Cognitive Bias Detection Using Advanced Prompt Engineering—0
Accurate Uncertainty Estimation and Decomposition in Ensemble Learning—0
Adding Instructions during Pretraining: Effective Way of Controlling Toxicity in Language Models—0
A Deep Dive into Effects of Structural Bias on CMA-ES Performance along Affine Trajectories—0
A Keyword Based Approach to Understanding the Overpenalization of Marginalized Groups by English Marginal Abuse Models on Twitter—0
A Meta Survey of Quality Evaluation Criteria in Explanation Methods—0
Anatomizing Bias in Facial Analysis—0
An Interdisciplinary Approach for the Automated Detection and Visualization of Media Bias in News Articles—0
Annotating and Analyzing Biased Sentences in News Articles using Crowdsourcing—0
A Novel Method for News Article Event-Based Embedding—0
Any Large Language Model Can Be a Reliable Judge: Debiasing with a Reasoning-based Bias Detector—0
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training—0
A Study on Bias Detection and Classification in Natural Language Processing—0
A Survey on Predicting the Factuality and the Bias of News Media—0
Auditing a Dutch Public Sector Risk Profiling Algorithm Using an Unsupervised Bias Detection Tool—0
Auditing Algorithmic Fairness in Machine Learning for Health with Severity-Based LOGAN—0
Auditing Predictive Models for Intersectional Biases—0
Back to Square One: Artifact Detection, Training and Commonsense Disentanglement in the Winograd Schema—0
BEADs: Bias Evaluation Across Domains—0
BENN: Bias Estimation Using Deep Neural Network—0
Beyond Explanation: A Case for Exploratory Text Visualizations of Non-Aggregated, Annotated Datasets—0
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs—0
Bias Analysis of AI Models for Undergraduate Student Admissions—0
Bias Detection via Maximum Subgroup Discrepancy—0
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models—0
Exploiting Transformer-based Multitask Learning for the Detection of Media Bias in News Articles—0
Extending Variability-Aware Model Selection with Bias Detection in Machine Learning Projects—0
Fair Is Better than Sensational: Man Is to Doctor as Woman Is to Doctor—0
Fairness via AI: Bias Reduction in Medical Information—0
FairT2I: Mitigating Social Bias in Text-to-Image Generation via Large Language Model-Assisted Detection and Attribute Rebalancing—0
Fine-Grained Bias Detection in LLM: Enhancing detection mechanisms for nuanced biases—0
Implications of the AI Act for Non-Discrimination Law and Algorithmic Fairness—0
Improved Models for Media Bias Detection and Subcategorization—0
Incorporating Subjectivity into Gendered Ambiguous Pronoun (GAP) Resolution using Style Transfer—0
Inferring bias and uncertainty in camera calibration—0
InsideBias: Measuring Bias in Deep Networks and Application to Face Gender Biometrics—0
Investigating Bias in Image Classification using Model Explanations—0
iReason: Multimodal Commonsense Reasoning using Videos and Natural Language with Interpretability—0
Large Language Model (LLM) Bias Index -- LLMBI—0
Large-scale news entity sentiment analysis—0
LLMs can be easily Confused by Instructional Distractions—0
Split and Expand: An inference-time improvement for Weakly Supervised Cell Instance Segmentation—0
MBIC -- A Media Bias Annotation Dataset Including Annotator Characteristics—0
MediaSpin: Exploring Media Bias Through Fine-Grained Analysis of News Headlines—0
Modeling Multi-level Context for Informational Bias Detection by Contrastive Learning and Sentential Graph Network—0
MRCLens: an MRC Dataset Bias Detection Toolkit—0
MRCLens: an MRC Dataset Bias Detection Toolkit—0
Multilingual Bias Detection and Mitigation for Indian Languages—0
Neutralizing the Narrative: AI-Powered Debiasing of Online News Articles—0
On the Mutual Influence of Gender and Occupation in LLM Representations—0
Show:102550
← PrevPage 2 of 4Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GPT-2 (small)ICAT Score72.97—Unverified
2XLNet (large)ICAT Score72.03—Unverified
3GPT-2 (medium)ICAT Score71.73—Unverified
4BERT (base)ICAT Score71.21—Unverified
5GPT-2 (large)ICAT Score70.54—Unverified
6BERT (large)ICAT Score69.89—Unverified
7RoBERTa (base)ICAT Score67.5—Unverified
8GAL 120BICAT Score65.6—Unverified
9XLNet (base)ICAT Score62.1—Unverified
10GPT-3 (text-davinci-002)ICAT Score60.8—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT-4Best-of0.5—Unverified
2BaselineBest-of0.41—Unverified
3GemmaBest-of0.41—Unverified
4MistralBest-of0.36—Unverified
5Llama2Best-of0.34—Unverified
#ModelMetricClaimedVerifiedStatus
1BADICAT Score23.44—Unverified
#ModelMetricClaimedVerifiedStatus
1RandomForest_default_hyperparametersAccuracy (%)49—Unverified
#ModelMetricClaimedVerifiedStatus
1RoBERTa+ALBERTF170.4—Unverified