Common Sense Reasoning

Common sense reasoning tasks are intended to require the model to go beyond pattern recognition. Instead, the model should use "common sense" or world knowledge to make inferences.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 601–650 of 939 papers

Title	Date	Tasks	Status	Hype
TR at SemEval-2020 Task 4: Exploring the Limits of Language-model-based Common Sense Validation	Dec 1, 2020	Common Sense ReasoningGraph Embedding	—Unverified	0
NLP@JUST at SemEval-2020 Task 4: Ensemble Technique for BERT and Roberta to Evaluate Commonsense Validation	Dec 1, 2020	Common Sense Reasoning	—Unverified	0
TeamJUST at SemEval-2020 Task 4: Commonsense Validation and Explanation Using Ensembling Techniques	Dec 1, 2020	Common Sense ReasoningSentence	—Unverified	0
BLCU-NLP at SemEval-2020 Task 5: Data Augmentation for Efficient Counterfactual Detecting	Dec 1, 2020	Common Sense Reasoningcounterfactual	—Unverified	0
DEEPYANG at SemEval-2020 Task 4: Using the Hidden Layer State of BERT Model for Differentiating Common Sense	Dec 1, 2020	Common Sense ReasoningNatural Language Understanding	—Unverified	0
Mxgra at SemEval-2020 Task 4: Common Sense Making with Next Token Prediction	Dec 1, 2020	Common Sense ReasoningLanguage Modeling	—Unverified	0
UoR at SemEval-2020 Task 4: Pre-trained Sentence Transformer Models for Commonsense Validation and Explanation	Dec 1, 2020	Common Sense ReasoningSentence	—Unverified	0
SSN-NLP at SemEval-2020 Task 4: Text Classification and Generation on Common Sense Context Using Neural Networks	Dec 1, 2020	Common Sense ReasoningMachine Translation	—Unverified	0
Zero-Shot Calibration of Fisheye Cameras	Nov 30, 2020	Camera CalibrationCommon Sense Reasoning	—Unverified	0
Tackling Domain-Specific Winograd Schemas with Knowledge-Based Reasoning and Machine Learning	Nov 24, 2020	BIG-bench Machine LearningCommon Sense Reasoning	CodeCode Available	0
Zero-Shot Learning with Knowledge Enhanced Visual Semantic Embeddings	Nov 21, 2020	Common Sense ReasoningZero-Shot Learning	—Unverified	0
Generating Natural Questions from Images for Multimodal Assistants	Nov 17, 2020	Common Sense ReasoningNatural Questions	—Unverified	0
iPerceive: Applying Common-Sense Reasoning to Multi-Modal Dense Video Captioning and Video Question Answering	Nov 16, 2020	Common Sense ReasoningDense Video Captioning	—Unverified	0
An Analysis of Dataset Overlap on Winograd-Style Tasks	Nov 9, 2020	Common Sense Reasoning	CodeCode Available	0
Machine Reasoning: Technology, Dilemma and Future	Nov 1, 2020	Common Sense Reasoning	—Unverified	0
Thinking Like a Skeptic: Defeasible Inference in Natural Language	Nov 1, 2020	Common Sense ReasoningNatural Language Inference	CodeCode Available	1
Representation, Learning and Reasoning on Spatial Language for Downstream NLP Tasks	Nov 1, 2020	Common Sense ReasoningQuestion Answering	—Unverified	0
ConceptBert: Concept-Aware Representation for Visual Question Answering	Nov 1, 2020	Common Sense ReasoningQuestion Answering	CodeCode Available	1
Learning Physical Common Sense as Knowledge Graph Completion via BERT Data Augmentation and Constrained Tucker Factorization	Nov 1, 2020	Common Sense ReasoningData Augmentation	—Unverified	0
A Knowledge-Aware Sequence-to-Tree Network for Math Word Problem Solving	Nov 1, 2020	Common Sense ReasoningDecoder	—Unverified	0
RussianSuperGLUE: A Russian Language Understanding Evaluation Benchmark	Oct 29, 2020	Common Sense ReasoningDiagnostic	CodeCode Available	1
Dutch Humor Detection by Generating Negative Examples	Oct 26, 2020	Binary ClassificationCommon Sense Reasoning	—Unverified	0
Pre-training Text-to-Text Transformers for Concept-centric Common Sense	Oct 24, 2020	Common Sense ReasoningKnowledge Graphs	CodeCode Available	1
GO FIGURE: A Meta Evaluation of Factuality in Summarization	Oct 24, 2020	Common Sense ReasoningDiagnostic	—Unverified	0
mT5: A massively multilingual pre-trained text-to-text transformer	Oct 22, 2020	Common Sense ReasoningNatural Language Inference	CodeCode Available	1
Thinking Fast and Slow in AI	Oct 12, 2020	Common Sense ReasoningDecision Making	—Unverified	0
Do Language Embeddings Capture Scales?	Oct 11, 2020	Common Sense Reasoning	—Unverified	0
Text-based RL Agents with Commonsense Knowledge: New Challenges, Environments and Baselines	Oct 8, 2020	Common Sense ReasoningCommonsense Reasoning for RL	CodeCode Available	1
Hierarchical Relational Inference	Oct 7, 2020	Common Sense Reasoning	—Unverified	0
LUKE: Deep Contextualized Entity Representations with Entity-aware Self-attention	Oct 2, 2020	Common Sense ReasoningEntity Typing	CodeCode Available	1
Creative Captioning: An AI Grand Challenge Based on the Dixit Board Game	Sep 30, 2020	Common Sense Reasoning	—Unverified	0
Zero-Shot Learning with Common Sense Knowledge Graphs	Sep 28, 2020	Common Sense ReasoningEntity Typing	—Unverified	0
Generating similes effortlessly like a Pro: A Style Transfer Approach for Simile Generation	Sep 18, 2020	Common Sense ReasoningSentence	CodeCode Available	1
Finding Effective Security Strategies through Reinforcement Learning and Self-Play	Sep 17, 2020	Common Sense Reasoningreinforcement-learning	CodeCode Available	1
Multi-modal Cooking Workflow Construction for Food Recipes	Aug 20, 2020	Common Sense ReasoningDecoder	—Unverified	0
Commonsense Knowledge in Wikidata	Aug 18, 2020	Common Sense ReasoningQuestion Answering	—Unverified	0
Learning Long-term Visual Dynamics with Region Proposal Interaction Networks	Aug 5, 2020	Common Sense ReasoningObject	CodeCode Available	1
Learning Object Placement by Inpainting for Compositional Data Augmentation	Aug 1, 2020	Common Sense ReasoningData Augmentation	—Unverified	0
Perceiving 3D Human-Object Spatial Arrangements from a Single Image in the Wild	Jul 30, 2020	3D Human Pose Estimation3D Human Reconstruction	CodeCode Available	1
CS-NET at SemEval-2020 Task 4: Siamese BERT for ComVE	Jul 21, 2020	Common Sense Reasoning	CodeCode Available	0
Understanding Spatial Relations through Multiple Modalities	Jul 19, 2020	Common Sense ReasoningImplicit Relations	—Unverified	0
Pasadena: Perceptually Aware and Stealthy Adversarial Denoise Attack	Jul 14, 2020	Adversarial AttackCommon Sense Reasoning	—Unverified	0
Evaluation Toolkit For Robustness Testing Of Automatic Essay Scoring Systems	Jul 14, 2020	Automated Essay ScoringCommon Sense Reasoning	CodeCode Available	1
Robustness to Spurious Correlations via Human Annotations	Jul 13, 2020	Common Sense Reasoning	CodeCode Available	0
Explainable Inference on Sequential Data via Memory-Tracking	Jul 11, 2020	Cloze TestCommon Sense Reasoning	CodeCode Available	0
LMVE at SemEval-2020 Task 4: Commonsense Validation and Explanation using Pretraining Language Model	Jul 6, 2020	Common Sense ReasoningLanguage Modeling	—Unverified	0
Event2Mind for Russian: Understanding Emotions and Intents in Texts. Corpus and Model for Evaluation	Jun 17, 2020	Common Sense Reasoning	CodeCode Available	1
Evidence-Aware Inferential Text Generation with Vector Quantised Variational AutoEncoder	Jun 15, 2020	Common Sense ReasoningDecoder	CodeCode Available	1
Machine Common Sense	Jun 15, 2020	Common Sense ReasoningFormal Logic	—Unverified	0
CUHK at SemEval-2020 Task 4: CommonSense Explanation, Reasoning and Prediction with Multi-task Learning	Jun 12, 2020	Common Sense ReasoningERP	—Unverified	0

Show:10 25 50

← PrevPage 13 of 19Next →

All datasets WinoGrande arc_challenge arc_easy ReCoRD CommonsenseQA PARus RuCoS RWSD BIG-bench (Causal Judgment)BIG-bench (Date Understanding)BIG-bench (Disambiguation QA)BIG-bench (Sports Understanding)

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ST-MoE-32B 269B (fine-tuned)	Accuracy	96.1	—	Unverified
2	Unicorn 11B (fine-tuned)	Accuracy	91.3	—	Unverified
3	CompassMTL 567M with Tailor	Accuracy	90.5	—	Unverified
4	CompassMTL 567M	Accuracy	89.6	—	Unverified
5	UnifiedQA 11B (fine-tuned)	Accuracy	89.4	—	Unverified
6	Claude 3 Opus (5-shot)	Accuracy	88.5	—	Unverified
7	GPT-4 (5-shot)	Accuracy	87.5	—	Unverified
8	ExDeBERTa 567M	Accuracy	87	—	Unverified
9	LLaMA-2 13B + MixLoRA	Accuracy	86.3	—	Unverified
10	LLaMA3 8B+MoSLoRA	Accuracy	85.8	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	GPT-4 (few-shot, k=25)	Accuracy	96.4	—	Unverified
2	PaLM 2 (few-shot, CoT, SC)	Accuracy	95.1	—	Unverified
3	Shivaay (4B, few-shot, k=8)	Accuracy	91.04	—	Unverified
4	StupidLLM	Accuracy	91.03	—	Unverified
5	Claude 2 (few-shot, k=5)	Accuracy	91	—	Unverified
6	Claude 1.3 (few-shot, k=5)	Accuracy	90	—	Unverified
7	PaLM 540B (Self Improvement, Self Consistency)	Accuracy	89.8	—	Unverified
8	PaLM 540B (Self Consistency)	Accuracy	88.7	—	Unverified
9	PaLM 540B (Self Improvement, CoT Prompting)	Accuracy	88.3	—	Unverified
10	PaLM 540B (Self Improvement, Standard-Prompting)	Accuracy	87.2	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	ST-MoE-32B 269B (fine-tuned)	Accuracy	95.2	—	Unverified
2	LLaMA 3 8B+MoSLoRA (fine-tuned)	Accuracy	90.5	—	Unverified
3	PaLM 2-L (1-shot)	Accuracy	89.7	—	Unverified
4	PaLM 2-M (1-shot)	Accuracy	88	—	Unverified
5	LLaMA-3 8B + MixLoRA	Accuracy	86.5	—	Unverified
6	Camelidae-8×34B	Accuracy	86.2	—	Unverified
7	PaLM 2-S (1-shot)	Accuracy	85.6	—	Unverified
8	LLaMA 65B + CFG (0-shot)	Accuracy	84.2	—	Unverified
9	GAL 120B (0-shot)	Accuracy	83.8	—	Unverified
10	LLaMA-2 13B + MixLoRA	Accuracy	83.5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Turing NLR v5 XXL 5.4B (fine-tuned)	EM	95.9	—	Unverified
2	ST-MoE-32B 269B (fine-tuned)	EM	95.1	—	Unverified
3	T5-11B	F1	94.1	—	Unverified
4	DeBERTa-1.5B	EM	94.1	—	Unverified
5	PaLM 540B (finetuned)	EM	94	—	Unverified
6	Vega v2 6B (fine-tuned)	EM	93.9	—	Unverified
7	PaLM 2-L (one-shot)	F1	93.8	—	Unverified
8	T5-XXL 11B (fine-tuned)	EM	93.4	—	Unverified
9	PaLM 2-M (one-shot)	F1	92.4	—	Unverified
10	PaLM 2-S (one-shot)	F1	92.1	—	Unverified