SOTAVerified|Agents Browse Leaderboard About Blog

General Knowledge

This task aims to evaluate the ability of a model to answer general-knowledge questions.

Source: BIG-bench

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 31–40 of 399 papers

Title	Date	Tasks	Status	Hype	Score
ElecBench: a Power Dispatch Evaluation Benchmark for Large Language Models	Jul 7, 2024	FairnessGeneral Knowledge	CodeCode Available	1	5
CurriculumLoc: Enhancing Cross-Domain Geolocalization through Multi-Stage Refinement	Nov 20, 2023	General KnowledgeKeypoint Detection	CodeCode Available	1	5
A Dual-Space Framework for General Knowledge Distillation of Large Language Models	Apr 15, 2025	Code GenerationGeneral Knowledge	CodeCode Available	1	5
E2Map: Experience-and-Emotion Map for Self-Reflective Robot Navigation with Language Models	Sep 16, 2024	General KnowledgeRobot Navigation	CodeCode Available	1	5
EPVT: Environment-aware Prompt Vision Transformer for Domain Generalization in Skin Lesion Recognition	Apr 4, 2023	Domain GeneralizationGeneral Knowledge	CodeCode Available	1	5
A New Learning Paradigm for Foundation Model-based Remote Sensing Change Detection	Dec 2, 2023	Building change detection for remote sensing imagesChange Detection	CodeCode Available	1	5
Dynamic Graph Enhanced Contrastive Learning for Chest X-ray Report Generation	Mar 18, 2023	Contrastive LearningDecoder	CodeCode Available	1	5
Can LLM Generate Culturally Relevant Commonsense QA Data? Case Study in Indonesian and Sundanese	Feb 27, 2024	General KnowledgeQuestion Answering	CodeCode Available	1	5
CC-Riddle: A Question Answering Dataset of Chinese Character Riddles	Jun 28, 2022	General KnowledgeLanguage Modelling	CodeCode Available	1	5
Aligning Medical Images with General Knowledge from Large Language Models	Aug 31, 2024	General KnowledgeMedical Image Analysis	CodeCode Available	1	5

Show:10 25 50

← PrevPage 4 of 40Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	Chinchilla-70B (few-shot, k=5)	Accuracy	94.3	—	Unverified
2	Gopher-280B (few-shot, k=5)	Accuracy	93.9	—	Unverified
3	Chinchilla-70B (few-shot, k=5)	Accuracy	85.7	—	Unverified
4	Gopher-280B (few-shot, k=5)	Accuracy	84.8	—	Unverified
5	Gopher-280B (few-shot, k=5)	Accuracy	84.2	—	Unverified
6	Gopher-280B (few-shot, k=5)	Accuracy	84.1	—	Unverified
7	Gopher-280B (few-shot, k=5)	Accuracy	83.9	—	Unverified
8	Gopher-280B (few-shot, k=5)	Accuracy	83.3	—	Unverified
9	Gopher-280B (few-shot, k=5)	Accuracy	81.8	—	Unverified
10	Gopher-280B (few-shot, k=5)	Accuracy	81	—	Unverified