SOTAVerified

Explanation Generation

Papers

Showing 1–10 of 235 papers

TitleStatusHype
MACRec: a Multi-Agent Collaboration Framework for RecommendationCode2
Rethinking Vision-Language Model in Face Forensics: Multi-Modal Interpretable Forged Face DetectorCode2
Explainable Automated Fact-Checking for Public Health ClaimsCode1
CodeExp: Explanatory Code Document GenerationCode1
End-to-End Multimodal Fact-Checking and Explanation Generation: A Challenging Dataset and ModelsCode1
EX-FEVER: A Dataset for Multi-hop Explainable Fact VerificationCode1
A Survey on Interpretable Cross-modal ReasoningCode1
A Comprehensive Evaluation of GPT-4V on Knowledge-Intensive Visual Question AnsweringCode1
CLEVR-X: A Visual Reasoning Dataset for Natural Language ExplanationsCode1
Retrieval augmentation of large language models for lay language generationCode1
Show:102550
← PrevPage 1 of 24Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1VLIS (Lynx)Accuracy80—Unverified
2VLIS (LLaVA)Accuracy73—Unverified
3Ground-truth Caption -> GPT3 (Oracle)Human (%)68—Unverified
4Predicted Caption -> GPT3Human (%)33—Unverified
5BLIP2 FlanT5-XXL (Fine-tuned)Human (%)27—Unverified
6BLIP2 FlanT5-XL (Fine-tuned)Human (%)15—Unverified
7BLIP2 FlanT5-XXL (Zero-shot)Human (%)0—Unverified
#ModelMetricClaimedVerifiedStatus
1PJ-XB487.4—Unverified
2FMB478.8—Unverified
#ModelMetricClaimedVerifiedStatus
1OFA-XHuman Explanation Rating85.7—Unverified
2OFA-X-MTHuman Explanation Rating80.4—Unverified
#ModelMetricClaimedVerifiedStatus
1OFA-X-MTHuman Explanation Rating77.3—Unverified
2OFA-XHuman Explanation Rating68.9—Unverified
#ModelMetricClaimedVerifiedStatus
1OFA-XHuman Explanation Rating89.5—Unverified
2OFA-X-MTHuman Explanation Rating87.8—Unverified