General Knowledge

This task aims to evaluate the ability of a model to answer general-knowledge questions.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 51–100 of 399 papers

Title	Date	Tasks	Status	Hype	Score
GeoGalactica: A Scientific Large Language Model in Geoscience	Dec 31, 2023	Document ClassificationGeneral Knowledge	CodeCode Available	1	5
BEAMetrics: A Benchmark for Language Generation Evaluation Evaluation	Oct 18, 2021	General KnowledgeInformativeness	CodeCode Available	1	5
Prompt Learning via Meta-Regularization	Apr 1, 2024	Domain GeneralizationGeneral Knowledge	CodeCode Available	1	5
Importance-based Neuron Allocation for Multilingual Neural Machine Translation	Jul 14, 2021	General KnowledgeMachine Translation	CodeCode Available	1	5
RAG with Differential Privacy	Dec 26, 2024	General KnowledgeRAG	CodeCode Available	1	5
KGPT: Knowledge-Grounded Pre-Training for Data-to-Text Generation	Oct 5, 2020	Data-to-Text GenerationGeneral Knowledge	CodeCode Available	1	5
KALA: Knowledge-Augmented Language Model Adaptation	Apr 22, 2022	Domain AdaptationGeneral Knowledge	CodeCode Available	1	5
Pre-training and Diagnosing Knowledge Base Completion Models	Jan 27, 2024	General KnowledgeKnowledge Base Completion	CodeCode Available	1	5
Can Editing LLMs Inject Harm?	Jul 29, 2024	FairnessGeneral Knowledge	CodeCode Available	1	5
Knowledge Prompt-tuning for Sequential Recommendation	Aug 14, 2023	General KnowledgeSequential Recommendation	CodeCode Available	1	5
Can LLM Generate Culturally Relevant Commonsense QA Data? Case Study in Indonesian and Sundanese	Feb 27, 2024	General KnowledgeQuestion Answering	CodeCode Available	1	5
Knowledge Graph Contrastive Learning for Recommendation	May 2, 2022	Contrastive LearningGeneral Knowledge	CodeCode Available	1	5
Aligning Medical Images with General Knowledge from Large Language Models	Aug 31, 2024	General KnowledgeMedical Image Analysis	CodeCode Available	1	5
Prediction and Control in Continual Reinforcement Learning	Dec 18, 2023	Continual LearningGeneral Knowledge	CodeCode Available	1	5
PMET: Precise Model Editing in a Transformer	Aug 17, 2023	General Knowledgemodel	CodeCode Available	1	5
Few-Shot Class-Incremental Learning via Class-Aware Bilateral Distillation	Jan 1, 2023	class-incremental learningClass Incremental Learning	CodeCode Available	1	5
Point-PRC: A Prompt Learning Based Regulation Framework for Generalizable Point Cloud Analysis	Oct 27, 2024	Domain GeneralizationGeneral Knowledge	CodeCode Available	1	5
Prompt-aligned Gradient for Prompt Tuning	May 30, 2022	Domain AdaptationFew-Shot Learning	CodeCode Available	1	5
RDF2Vec: RDF Graph Embeddings and Their Applications	Nov 10, 2017	Entity EmbeddingsGeneral Knowledge	CodeCode Available	1	5
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models	Feb 21, 2024	General KnowledgeLogical Reasoning	CodeCode Available	1	5
Overcoming Generic Knowledge Loss with Selective Parameter Update	Aug 23, 2023	Continual LearningGeneral Knowledge	CodeCode Available	1	5
MIANet: Aggregating Unbiased Instance and General Information for Few-Shot Semantic Segmentation	May 23, 2023	Few-Shot Semantic SegmentationGeneral Knowledge	CodeCode Available	1	5
ElecBench: a Power Dispatch Evaluation Benchmark for Large Language Models	Jul 7, 2024	FairnessGeneral Knowledge	CodeCode Available	1	5
A General Knowledge Injection Framework for ICD Coding	May 24, 2025	General Knowledge	CodeCode Available	1	5
Me, Myself, and AI: The Situational Awareness Dataset (SAD) for LLMs	Jul 5, 2024	General KnowledgeInstruction Following	CodeCode Available	1	5
MultiGPrompt for Multi-Task Pre-Training and Prompting on Graphs	Nov 28, 2023	General KnowledgeGraph Representation Learning	CodeCode Available	1	5
A Comprehensive Evaluation of GPT-4V on Knowledge-Intensive Visual Question Answering	Nov 13, 2023	Decision MakingExplanation Generation	CodeCode Available	1	5
EPVT: Environment-aware Prompt Vision Transformer for Domain Generalization in Skin Lesion Recognition	Apr 4, 2023	Domain GeneralizationGeneral Knowledge	CodeCode Available	1	5
Automated Phrase Mining from Massive Text Corpora	Feb 15, 2017	General KnowledgePOS	CodeCode Available	1	5
PANDA: Prompt Transfer Meets Knowledge Distillation for Efficient Model Adaptation	Aug 22, 2022	General KnowledgeKnowledge Distillation	CodeCode Available	1	5
GKD: A General Knowledge Distillation Framework for Large-scale Pre-trained Language Model	Jun 11, 2023	General KnowledgeKnowledge Distillation	CodeCode Available	1	5
DomainRAG: A Chinese Benchmark for Evaluating Domain-specific Retrieval-Augmented Generation	Jun 9, 2024	Common Sense ReasoningDenoising	CodeCode Available	1	5
DR-Tune: Improving Fine-tuning of Pretrained Visual Models by Distribution Regularization with Semantic Calibration	Aug 23, 2023	General Knowledgeimage-classification	CodeCode Available	1	5
Learning with Recoverable Forgetting	Jul 17, 2022	General KnowledgeTransfer Learning	CodeCode Available	1	5
CRoFT: Robust Fine-Tuning with Concurrent Optimization for OOD Generalization and Open-Set OOD Detection	May 26, 2024	General Knowledge	CodeCode Available	1	5
CurriculumLoc: Enhancing Cross-Domain Geolocalization through Multi-Stage Refinement	Nov 20, 2023	General KnowledgeKeypoint Detection	CodeCode Available	1	5
Dynamic Graph Enhanced Contrastive Learning for Chest X-ray Report Generation	Mar 18, 2023	Contrastive LearningDecoder	CodeCode Available	1	5
DA-Ada: Learning Domain-Aware Adapter for Domain Adaptive Object Detection	Oct 11, 2024	General Knowledgeobject-detection	CodeCode Available	1	5
BEAR: A Unified Framework for Evaluating Relational Knowledge in Causal and Masked Language Models	Apr 5, 2024	Factual probeGeneral Knowledge	CodeCode Available	1	5
Towards Task Sampler Learning for Meta-Learning	Jul 18, 2023	DiversityFew-Shot Learning	CodeCode Available	1	5
FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion	Mar 6, 2025	General KnowledgeInstruction Following	CodeCode Available	1	5
Decoupling General and Personalized Knowledge in Federated Learning via Additive and Low-Rank Decomposition	Jun 28, 2024	Federated LearningGeneral Knowledge	CodeCode Available	1	5
Benchmarking Large Language Models for Persian: A Preliminary Study Focusing on ChatGPT	Apr 3, 2024	BenchmarkingGeneral Knowledge	CodeCode Available	1	5
DIAGen: Diverse Image Augmentation with Generative Models	Aug 26, 2024	Data AugmentationGeneral Knowledge	CodeCode Available	1	5
Bert4XMR: Cross-Market Recommendation with Bidirectional Encoder Representations from Transformer	May 24, 2023	General KnowledgeTransfer Learning	CodeCode Available	1	5
Go From the General to the Particular: Multi-Domain Translation with Domain Transformation Networks	Nov 22, 2019	DecoderGeneral Knowledge	CodeCode Available	1	5
Better Question-Answering Models on a Budget	Apr 24, 2023	General KnowledgeQuestion Answering	CodeCode Available	1	5
Health Index Estimation Through Integration of General Knowledge with Unsupervised Learning	May 8, 2024	General Knowledge	CodeCode Available	1	5
Dual Modality Prompt Tuning for Vision-Language Pre-Trained Model	Aug 17, 2022	General KnowledgeLanguage Modelling	CodeCode Available	1	5
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks	Jun 20, 2024	General KnowledgeHuman Dynamics	CodeCode Available	1	5

Show:10 25 50

← PrevPage 2 of 8Next →

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	Chinchilla-70B (few-shot, k=5)	Accuracy	94.3	—	Unverified
2	Gopher-280B (few-shot, k=5)	Accuracy	93.9	—	Unverified
3	Chinchilla-70B (few-shot, k=5)	Accuracy	85.7	—	Unverified
4	Gopher-280B (few-shot, k=5)	Accuracy	84.8	—	Unverified
5	Gopher-280B (few-shot, k=5)	Accuracy	84.2	—	Unverified
6	Gopher-280B (few-shot, k=5)	Accuracy	84.1	—	Unverified
7	Gopher-280B (few-shot, k=5)	Accuracy	83.9	—	Unverified
8	Gopher-280B (few-shot, k=5)	Accuracy	83.3	—	Unverified
9	Gopher-280B (few-shot, k=5)	Accuracy	81.8	—	Unverified
10	Gopher-280B (few-shot, k=5)	Accuracy	81	—	Unverified