SOTAVerified

Fact Checking

Papers

Showing 201–225 of 669 papers

TitleStatusHype
Rematch: Robust and Efficient Matching of Local Knowledge Graphs to Improve Structural and Semantic SimilarityCode0
Fact Checking Beyond Training SetCode0
QuanTemp: A real-world open-domain benchmark for fact-checking numerical claimsCode0
Attribute First, then Generate: Locally-attributable Grounded Text GenerationCode1
RU22Fact: Optimizing Evidence for Multilingual Explainable Fact-Checking on Russia-Ukraine ConflictCode0
Ax-to-Grind Urdu: Benchmark Dataset for Urdu Fake News DetectionCode0
Embedded Named Entity Recognition using Probing ClassifiersCode0
Correcting misinformation on social media with a large language modelCode0
MCFEND: A Multi-source Benchmark Dataset for Chinese Fake News Detection—0
ClaimVer: Explainable Claim-Level Verification and Evidence Attribution of Text Through Knowledge Graphs—0
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification—0
Multimodal Large Language Models to Support Real-World Fact-Checking—0
Cross-Lingual Learning vs. Low-Resource Fine-Tuning: A Case Study with Fact-Checking in TurkishCode0
CFEVER: A Chinese Fact Extraction and VERification DatasetCode0
Heterogeneous Graph Reasoning for Fact Checking over Texts and TablesCode1
Repetitive Dilemma Games in Distribution Information Using Interplay of Droop Quota: Meek's Method in Impact of Maximum Compensation and Minimum Cost Routes in Information Role of Marginal Contribution in Two-Sided Matching Markets—0
TrustScore: Reference-Free Evaluation of LLM Response TrustworthinessCode0
GenAudit: Fixing Factual Errors in Language Model Outputs with Evidence—0
Tables as Texts or Images: Evaluating the Table Reasoning Ability of LLMs and MLLMs—0
Surprising Efficacy of Fine-Tuned Transformers for Fact-Checking over Larger Language Models—0
Entanglement: Balancing Punishment and Compensation, Repeated Dilemma Game-Theoretic Analysis of Maximum Compensation Problem for Bypass and Least Cost Paths in Fact-Checking, Case of Fake News with Weak Wallace's Law—0
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM AnnotatorsCode0
Can LLMs Produce Faithful Explanations For Fact-checking? Towards Faithful Explainable Fact-Checking via Multi-Agent Debate—0
EntGPT: Linking Generative Large Language Models with Knowledge BasesCode0
Explaining Veracity Predictions with Evidence Summarization: A Multi-Task Model ApproachCode0
Show:102550
← PrevPage 9 of 27Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.78—Unverified
2SGPT-BE-5.8BnDCG@100.75—Unverified
3BM25+CEnDCG@100.69—Unverified
4SGPT-CE-6.1BnDCG@100.68—Unverified
5ColBERTnDCG@100.67—Unverified
#ModelMetricClaimedVerifiedStatus
1SGPT-BE-5.8BnDCG@100.31—Unverified
2monoT5-3BnDCG@100.28—Unverified
3BM25+CEnDCG@100.25—Unverified
4SGPT-CE-6.1BnDCG@100.16—Unverified
#ModelMetricClaimedVerifiedStatus
1monoT5-3BnDCG@100.85—Unverified
2BM25+CEnDCG@100.82—Unverified
3SGPT-BE-5.8BnDCG@100.78—Unverified
4SGPT-CE-6.1BnDCG@100.73—Unverified
#ModelMetricClaimedVerifiedStatus
1HerOQuestion Only score0.48—Unverified
2CTU AICQuestion Only score0.46—Unverified
3InFactQuestion Only score0.45—Unverified
#ModelMetricClaimedVerifiedStatus
1Abc0..5sec2—Unverified
#ModelMetricClaimedVerifiedStatus
1MA-CINPrecision0.26—Unverified
#ModelMetricClaimedVerifiedStatus
1FDHNAccuracy (Test)0.7—Unverified