SOTAVerified

Bias Detection

Bias detection is the task of detecting and measuring racism, sexism and otherwise discriminatory behavior in a model (Source: https://stereoset.mit.edu/)

Papers

Showing 126–150 of 199 papers

TitleStatusHype
Uncovering Biases with Reflective Large Language Models—0
MBIC -- A Media Bias Annotation Dataset Including Annotator Characteristics—0
Visual Reasoning Evaluation of Grok, Deepseek Janus, Gemini, Qwen, Mistral, and ChatGPT—0
MediaSpin: Exploring Media Bias Through Fine-Grained Analysis of News Headlines—0
Unlocking Bias Detection: Leveraging Transformer-Based Models for Content Analysis—0
Toward Holistic Evaluation of Recommender Systems Powered by Generative Models—0
Modeling Multi-level Context for Informational Bias Detection by Contrastive Learning and Sentential Graph Network—0
MRCLens: an MRC Dataset Bias Detection Toolkit—0
MRCLens: an MRC Dataset Bias Detection Toolkit—0
Annotating and Analyzing Biased Sentences in News Articles using Crowdsourcing—0
Multilingual Bias Detection and Mitigation for Indian Languages—0
Towards A Reliable Ground-Truth For Biased Language Detection—0
Unmasking Bias in AI: A Systematic Review of Bias Detection and Mitigation Strategies in Electronic Health Record-based Models—0
Towards Detecting Political Bias in Hindi News Articles—0
An Interdisciplinary Approach for the Automated Detection and Visualization of Media Bias in News Articles—0
Anatomizing Bias in Facial Analysis—0
Neutralizing the Narrative: AI-Powered Debiasing of Online News Articles—0
Unmasking Conversational Bias in AI Multiagent Systems—0
A Meta Survey of Quality Evaluation Criteria in Explanation Methods—0
On the Mutual Influence of Gender and Occupation in LLM Representations—0
A Keyword Based Approach to Understanding the Overpenalization of Marginalized Groups by English Marginal Abuse Models on Twitter—0
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs—0
Bias Analysis of AI Models for Undergraduate Student Admissions—0
Beyond Explanation: A Case for Exploratory Text Visualizations of Non-Aggregated, Annotated Datasets—0
Bias Detection via Maximum Subgroup Discrepancy—0
Show:102550
← PrevPage 6 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GPT-2 (small)ICAT Score72.97—Unverified
2XLNet (large)ICAT Score72.03—Unverified
3GPT-2 (medium)ICAT Score71.73—Unverified
4BERT (base)ICAT Score71.21—Unverified
5GPT-2 (large)ICAT Score70.54—Unverified
6BERT (large)ICAT Score69.89—Unverified
7RoBERTa (base)ICAT Score67.5—Unverified
8GAL 120BICAT Score65.6—Unverified
9XLNet (base)ICAT Score62.1—Unverified
10GPT-3 (text-davinci-002)ICAT Score60.8—Unverified
#ModelMetricClaimedVerifiedStatus
1GPT-4Best-of0.5—Unverified
2BaselineBest-of0.41—Unverified
3GemmaBest-of0.41—Unverified
4MistralBest-of0.36—Unverified
5Llama2Best-of0.34—Unverified
#ModelMetricClaimedVerifiedStatus
1BADICAT Score23.44—Unverified
#ModelMetricClaimedVerifiedStatus
1RandomForest_default_hyperparametersAccuracy (%)49—Unverified
#ModelMetricClaimedVerifiedStatus
1RoBERTa+ALBERTF170.4—Unverified