SOTAVerified

Fact Checking

Papers

Showing 1–10 of 669 papers

TitleStatusHype
MiniCheck: Efficient Fact-Checking of LLMs on Grounding DocumentsCode7
Loki: An Open-Source Tool for Fact VerificationCode5
Semantic Operators: A Declarative Model for Rich, AI-based Data ProcessingCode5
Medical Graph RAG: Towards Safe Medical Large Language Model via Graph Retrieval-Augmented GenerationCode4
Don't Ignore Dual Logic Ability of LLMs while Privatizing: A Data-Intensive Analysis in Medical DomainCode4
Verdict: A Library for Scaling Judge-Time ComputeCode3
Search Arena: Analyzing Search-Augmented LLMsCode2
SemViQA: A Semantic Question Answering System for Vietnamese Information Fact-CheckingCode2
ChartGemma: Visual Instruction-tuning for Chart Reasoning in the WildCode2
OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMsCode2
Show:102550
← PrevPage 1 of 67Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.78—Unverified
2SGPT-BE-5.8BnDCG@100.75—Unverified
3BM25+CEnDCG@100.69—Unverified
4SGPT-CE-6.1BnDCG@100.68—Unverified
5ColBERTnDCG@100.67—Unverified
#ModelMetricClaimedVerifiedStatus
1SGPT-BE-5.8BnDCG@100.31—Unverified
2monoT5-3BnDCG@100.28—Unverified
3BM25+CEnDCG@100.25—Unverified
4SGPT-CE-6.1BnDCG@100.16—Unverified
#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.85—Unverified
2BM25+CEnDCG@100.82—Unverified
3SGPT-BE-5.8BnDCG@100.78—Unverified
4SGPT-CE-6.1BnDCG@100.73—Unverified
#ModelMetricClaimedVerifiedStatus
1HerOQuestion Only score0.48—Unverified
2CTU AICQuestion Only score0.46—Unverified
3InFactQuestion Only score0.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Abc0..5sec2—Unverified
#ModelMetricClaimedVerifiedStatus
1MA-CINPrecision0.26—Unverified
#ModelMetricClaimedVerifiedStatus
1FDHNAccuracy (Test)0.7—Unverified