Common Sense Reasoning

Common sense reasoning tasks are intended to require the model to go beyond pattern recognition. Instead, the model should use "common sense" or world knowledge to make inferences.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 301–350 of 939 papers

Title	Date	Tasks	Status
Affective Common Sense Knowledge Acquisition for Sentiment Analysis	May 1, 2012	Common Sense ReasoningDecision Making	—Unverified
Comprehension Based Question Answering using Bloom's Taxonomy	Jun 8, 2021	Common Sense ReasoningQuestion Answering	—Unverified
A Bayesian-Symbolic Approach to Reasoning and Learning in Intuitive Physics	Dec 1, 2021	Bayesian InferenceBilevel Optimization	—Unverified
Comparing Apples to Oranges: A Dataset & Analysis of LLM Humour Understanding from Traditional Puns to Topical Jokes	Jul 17, 2025	Common Sense ReasoningWorld Knowledge	—Unverified
A Discourse-Annotated Corpus of Conjoined VPs	Aug 1, 2016	Common Sense ReasoningMachine Translation	—Unverified
A Bayesian-Symbolic Approach to Learning and Reasoning for Intuitive Physics	Jan 1, 2021	Bayesian InferenceCommon Sense Reasoning	—Unverified
CommonsenseQA 2.0: Exposing the Limits of AI through Gamification	Jan 14, 2022	Common Sense ReasoningNatural Language Understanding	—Unverified
A Study on Neuro-Symbolic Artificial Intelligence: Healthcare Perspectives	Mar 23, 2025	BenchmarkingCommon Sense Reasoning	—Unverified
Commonsense Ontology Micropatterns	Feb 28, 2024	Common Sense Reasoning	—Unverified
A Strong Lexical Matching Method for the Machine Comprehension Test	Sep 1, 2015	Common Sense ReasoningCoreference Resolution	—Unverified
Align, Mask and Select: A Simple Method for Incorporating Commonsense Knowledge into Language Representation Models	Aug 19, 2019	Common Sense ReasoningNatural Language Inference	—Unverified
Hierarchical Relational Inference	Oct 7, 2020	Common Sense Reasoning	—Unverified
Common Sense Knowledge, Ontology and Text Mining for Implicit Requirements	Mar 21, 2021	Common Sense ReasoningManagement	—Unverified
A Statistical View on Synthetic Aperture Imaging for Occlusion Removal	Jun 15, 2019	Common Sense Reasoning	—Unverified
Align-GRAG: Reasoning-Guided Dual Alignment for Graph Retrieval-Augmented Generation	May 22, 2025	Common Sense ReasoningInformation Retrieval	—Unverified
Commonsense Knowledge in Wikidata	Aug 18, 2020	Common Sense ReasoningQuestion Answering	—Unverified
Commonsense Knowledge from Scene Graphs for Textual Environments	Oct 19, 2022	Common Sense Reasoningtext-based games	—Unverified
Assisting human experts in the interpretation of their visual process: A case study on assessing copper surface adhesive potency	Oct 24, 2019	Common Sense Reasoning	—Unverified
Heuristic Vision Pre-Training with Self-Supervised and Supervised Multi-Task Learning	Oct 11, 2023	Common Sense ReasoningContrastive Learning	—Unverified
Common Sense Is All You Need	Jan 11, 2025	AllARC	—Unverified
FRIDA to the Rescue! Analyzing Synthetic Data Effectiveness in Object-Based Common Sense Reasoning for Disaster Response	Feb 25, 2025	Common Sense ReasoningDisaster Response	—Unverified
Assessment of cognitive characteristics in intelligent systems and predictive ability	Sep 16, 2022	Common Sense Reasoning	—Unverified
Common-Sense Bias Modeling for Classification Tasks	Jan 24, 2024	ClassificationCommon Sense Reasoning	—Unverified
Aspect Extraction from Product Reviews Using Category Hierarchy Information	Apr 1, 2017	Aspect ExtractionCommon Sense Reasoning	—Unverified
A design of human-like robust AI machines in object identification	Jan 7, 2021	Causal InferenceCommon Sense Reasoning	—Unverified
HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator	Nov 26, 2024	Common Sense ReasoningLogical Reasoning	—Unverified
HGSGNLP at IEST 2018: An Ensemble of Machine Learning and Deep Neural Architectures for Implicit Emotion Classification in Tweets	Oct 1, 2018	Common Sense ReasoningEmotion Classification	—Unverified
FoundaBench: Evaluating Chinese Fundamental Knowledge Capabilities of Large Language Models	Apr 29, 2024	Common Sense ReasoningMultiple-choice	—Unverified
Forecasting Social Navigation in Crowded Complex Scenes	Jan 5, 2016	Common Sense ReasoningNavigate	—Unverified
Commonsense about Human Senses: Labeled Data Collection Processes	Nov 1, 2019	BIG-bench Machine LearningCommon Sense Reasoning	—Unverified
FirePlace: Geometric Refinements of LLM Common Sense Reasoning for 3D Object Placement	Jan 1, 2025	3D geometryCommon Sense Reasoning	—Unverified
Ask Me What You Need: Product Retrieval using Knowledge from GPT-3	Jul 6, 2022	Common Sense ReasoningQuestion Answering	—Unverified
Handling Multiword Expressions in Causality Estimation	Jan 1, 2017	Common Sense ReasoningQuestion Answering	—Unverified
COMMA-DEER: COmmon-sense Aware Multimodal Multitask Approach for Detection of Emotion and Emotional Reasoning in Conversations	Oct 1, 2022	Common Sense Reasoning	—Unverified
ADEPT: An Adjective-Dependent Plausibility Task	Aug 1, 2021	Common Sense ReasoningNatural Language Understanding	—Unverified
Fractional trends and cycles in macroeconomic time series	May 23, 2020	Common Sense ReasoningTime Series	—Unverified
Framework for Certification of AI-Based Systems	Feb 21, 2023	Common Sense Reasoning	—Unverified
Free Will Belief as a consequence of Model-based Reinforcement Learning	Nov 14, 2021	Common Sense ReasoningDecision Making	—Unverified
Fine-grained evaluation of Quality Estimation for Machine translation based on a linguistically motivated Test Suite	Mar 1, 2018	Automatic Post-EditingCommon Sense Reasoning	—Unverified
From Blind Solvers to Logical Thinkers: Benchmarking LLMs' Logical Integrity on Faulty Mathematical Problems	Oct 24, 2024	BenchmarkingCommon Sense Reasoning	—Unverified
From Common Sense Reasoning to Neural Network Models through Multiple Preferences: an overview	Jul 10, 2021	Common Sense Reasoning	—Unverified
Functional-level Uncertainty Quantification for Calibrated Fine-tuning on LLMs	Oct 9, 2024	Common Sense ReasoningMixture-of-Experts	—Unverified
Hallucination Detection in Foundation Models for Decision-Making: A Flexible Definition and Review of the State of the Art	Mar 25, 2024	Common Sense ReasoningDecision Making	—Unverified
FusionSense: Bridging Common Sense, Vision, and Touch for Robust Sparse-View Reconstruction	Oct 10, 2024	3D ReconstructionCommon Sense Reasoning	—Unverified
FVQA 2.0: Introducing Adversarial Samples into Fact-based Visual Question Answering	Mar 19, 2023	Common Sense ReasoningInformation Retrieval	—Unverified
FVQA: Fact-based Visual Question Answering	Jun 17, 2016	Common Sense ReasoningQuestion Answering	—Unverified
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering	May 22, 2024	Common Sense ReasoningGraph Question Answering	—Unverified
Common Sense Knowledge Learning for Open Vocabulary Neural Reasoning: A First View into Chronic Disease Literature	Nov 27, 2021	Common Sense Reasoning	—Unverified
Features of Verb Complements in Co-composition: A case study of Chinese baking verb using Weibo corpus	Sep 1, 2013	Common Sense ReasoningWord Sense Disambiguation	—Unverified
Combining PCFG-LA Models with Dual Decomposition: A Case Study with Function Labels and Binarization	Oct 1, 2013	BinarizationCommon Sense Reasoning	—Unverified

Show:10 25 50

← PrevPage 7 of 19Next →

All datasets WinoGrande arc_challenge arc_easy ReCoRD CommonsenseQA PARus RuCoS RWSD BIG-bench (Causal Judgment)BIG-bench (Date Understanding)BIG-bench (Disambiguation QA)BIG-bench (Sports Understanding)

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ST-MoE-32B 269B (fine-tuned)	Accuracy	96.1	—	Unverified
2	Unicorn 11B (fine-tuned)	Accuracy	91.3	—	Unverified
3	CompassMTL 567M with Tailor	Accuracy	90.5	—	Unverified
4	CompassMTL 567M	Accuracy	89.6	—	Unverified
5	UnifiedQA 11B (fine-tuned)	Accuracy	89.4	—	Unverified
6	Claude 3 Opus (5-shot)	Accuracy	88.5	—	Unverified
7	GPT-4 (5-shot)	Accuracy	87.5	—	Unverified
8	ExDeBERTa 567M	Accuracy	87	—	Unverified
9	LLaMA-2 13B + MixLoRA	Accuracy	86.3	—	Unverified
10	LLaMA3 8B+MoSLoRA	Accuracy	85.8	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	GPT-4 (few-shot, k=25)	Accuracy	96.4	—	Unverified
2	PaLM 2 (few-shot, CoT, SC)	Accuracy	95.1	—	Unverified
3	Shivaay (4B, few-shot, k=8)	Accuracy	91.04	—	Unverified
4	StupidLLM	Accuracy	91.03	—	Unverified
5	Claude 2 (few-shot, k=5)	Accuracy	91	—	Unverified
6	Claude 1.3 (few-shot, k=5)	Accuracy	90	—	Unverified
7	PaLM 540B (Self Improvement, Self Consistency)	Accuracy	89.8	—	Unverified
8	PaLM 540B (Self Consistency)	Accuracy	88.7	—	Unverified
9	PaLM 540B (Self Improvement, CoT Prompting)	Accuracy	88.3	—	Unverified
10	PaLM 540B (Self Improvement, Standard-Prompting)	Accuracy	87.2	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	ST-MoE-32B 269B (fine-tuned)	Accuracy	95.2	—	Unverified
2	LLaMA 3 8B+MoSLoRA (fine-tuned)	Accuracy	90.5	—	Unverified
3	PaLM 2-L (1-shot)	Accuracy	89.7	—	Unverified
4	PaLM 2-M (1-shot)	Accuracy	88	—	Unverified
5	LLaMA-3 8B + MixLoRA	Accuracy	86.5	—	Unverified
6	Camelidae-8×34B	Accuracy	86.2	—	Unverified
7	PaLM 2-S (1-shot)	Accuracy	85.6	—	Unverified
8	LLaMA 65B + CFG (0-shot)	Accuracy	84.2	—	Unverified
9	GAL 120B (0-shot)	Accuracy	83.8	—	Unverified
10	LLaMA-2 13B + MixLoRA	Accuracy	83.5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Turing NLR v5 XXL 5.4B (fine-tuned)	EM	95.9	—	Unverified
2	ST-MoE-32B 269B (fine-tuned)	EM	95.1	—	Unverified
3	T5-11B	F1	94.1	—	Unverified
4	DeBERTa-1.5B	EM	94.1	—	Unverified
5	PaLM 540B (finetuned)	EM	94	—	Unverified
6	Vega v2 6B (fine-tuned)	EM	93.9	—	Unverified
7	PaLM 2-L (one-shot)	F1	93.8	—	Unverified
8	T5-XXL 11B (fine-tuned)	EM	93.4	—	Unverified
9	PaLM 2-M (one-shot)	F1	92.4	—	Unverified
10	PaLM 2-S (one-shot)	F1	92.1	—	Unverified