SOTAVerified

Fact Checking

Papers

Showing 41–50 of 669 papers

TitleStatusHype
Pushing the boundary on Natural Language Inference—0
Assessing the Potential of Generative Agents in Crowdsourced Fact-Checking—0
PASS-FC: Progressive and Adaptive Search Scheme for Fact Checking of Comprehensive Claims—0
OLMoTrace: Tracing Language Model Outputs Back to Trillions of Training Tokens—0
BOOST: Bootstrapping Strategy-Driven Reasoning Programs for Program-Guided Fact-Checking—0
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs—0
Understanding Inequality of LLM Fact-Checking over Geographic Regions with Agent and Retrieval models—0
MultiClaimNet: A Massively Multilingual Dataset of Fact-Checked Claim Clusters—0
Fact-checking AI-generated news reports: Can LLMs catch their own lies?—0
Can LLMs Automate Fact-Checking Article Writing?—0
Show:102550
← PrevPage 5 of 67Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.78—Unverified
2SGPT-BE-5.8BnDCG@100.75—Unverified
3BM25+CEnDCG@100.69—Unverified
4SGPT-CE-6.1BnDCG@100.68—Unverified
5ColBERTnDCG@100.67—Unverified
#ModelMetricClaimedVerifiedStatus
1SGPT-BE-5.8BnDCG@100.31—Unverified
2monoT5-3BnDCG@100.28—Unverified
3BM25+CEnDCG@100.25—Unverified
4SGPT-CE-6.1BnDCG@100.16—Unverified
#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.85—Unverified
2BM25+CEnDCG@100.82—Unverified
3SGPT-BE-5.8BnDCG@100.78—Unverified
4SGPT-CE-6.1BnDCG@100.73—Unverified
#ModelMetricClaimedVerifiedStatus
1HerOQuestion Only score0.48—Unverified
2CTU AICQuestion Only score0.46—Unverified
3InFactQuestion Only score0.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Abc0..5sec2—Unverified
#ModelMetricClaimedVerifiedStatus
1MA-CINPrecision0.26—Unverified
#ModelMetricClaimedVerifiedStatus
1FDHNAccuracy (Test)0.7—Unverified