SOTAVerified

Fact Checking

Papers

Showing 171–180 of 669 papers

TitleStatusHype
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language ModelsCode1
SparseCL: Sparse Contrastive Learning for Contradiction Retrieval—0
Bag of Lies: Robustness in Continuous Pre-training BERT—0
Missci: Reconstructing Fallacies in Misrepresented ScienceCode0
Towards Detecting LLMs Hallucination via Markov Chain-based Multi-agent Debate Framework—0
Document-level Claim Extraction and Decontextualisation for Fact-CheckingCode1
RATT: A Thought Structure for Coherent and Correct LLM ReasoningCode1
FactGenius: Combining Zero-Shot Prompting and Fuzzy Relation Mining to Improve Fact Verification with Knowledge GraphsCode0
Are Large Vision Language Models up to the Challenge of Chart Comprehension and Reasoning? An Extensive Investigation into the Capabilities and Limitations of LVLMs—0
ExU: AI Models for Examining Multilingual Disinformation Narratives and Understanding their Spread—0
Show:102550
← PrevPage 18 of 67Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.78—Unverified
2SGPT-BE-5.8BnDCG@100.75—Unverified
3BM25+CEnDCG@100.69—Unverified
4SGPT-CE-6.1BnDCG@100.68—Unverified
5ColBERTnDCG@100.67—Unverified
#ModelMetricClaimedVerifiedStatus
1SGPT-BE-5.8BnDCG@100.31—Unverified
2monoT5-3BnDCG@100.28—Unverified
3BM25+CEnDCG@100.25—Unverified
4SGPT-CE-6.1BnDCG@100.16—Unverified
#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.85—Unverified
2BM25+CEnDCG@100.82—Unverified
3SGPT-BE-5.8BnDCG@100.78—Unverified
4SGPT-CE-6.1BnDCG@100.73—Unverified
#ModelMetricClaimedVerifiedStatus
1HerOQuestion Only score0.48—Unverified
2CTU AICQuestion Only score0.46—Unverified
3InFactQuestion Only score0.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Abc0..5sec2—Unverified
#ModelMetricClaimedVerifiedStatus
1MA-CINPrecision0.26—Unverified
#ModelMetricClaimedVerifiedStatus
1FDHNAccuracy (Test)0.7—Unverified