Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1026–1050 of 1961 papers

Title	Date	Tasks	Status
Stress Test Evaluation of Transformer-based Models in Natural Language Understanding Tasks	Feb 14, 2020	Natural Language InferenceNatural Language Understanding	—Unverified
Stress-Testing Neural Models of Natural Language Inference with Multiply-Quantified Sentences	Oct 30, 2018	Natural Language Inference	—Unverified
String Re-writing Kernel	Jul 1, 2012	Information RetrievalNatural Language Inference	—Unverified
Strong hallucinations from negation and how to fix them	Feb 16, 2024	Natural Language InferenceNegation	—Unverified
StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding	Aug 13, 2019	Language ModelingLanguage Modelling	—Unverified
Structural Representations for Learning Relations between Pairs of Texts	Jul 1, 2015	Feature EngineeringNatural Language Inference	—Unverified
STRUCTURED ALIGNMENT NETWORKS	Jan 1, 2018	Natural Language InferenceSentence	—Unverified
Structured Alignment Networks for Matching Sentences	Oct 1, 2018	Natural Language InferenceQuestion Answering	—Unverified
Structured Attention Networks	Feb 3, 2017	Machine TranslationNatural Language Inference	—Unverified
Structured Learning for Taxonomy Induction with Belief Propagation	Jun 1, 2014	Natural Language InferenceQuestion Answering	—Unverified
STS-UHH at SemEval-2017 Task 1: Scoring Semantic Textual Similarity Using Supervised and Unsupervised Ensemble	Aug 1, 2017	Graph SimilarityInformation Retrieval	—Unverified
Stubborn Lexical Bias in Data and Models	Jun 3, 2023	Natural Language Inference	—Unverified
Subword ELMo	Sep 18, 2019	Dependency ParsingNatural Language Inference	—Unverified
SufiSent - Universal Sentence Representations Using Suffix Encodings	Feb 20, 2018	Natural Language InferenceSentence	—Unverified
Supervised Distributional Hypernym Discovery via Domain Adaptation	Nov 1, 2016	ClusteringDomain Adaptation	—Unverified
Supervised Open Information Extraction	Jun 1, 2018	Knowledge Base PopulationNatural Language Inference	—Unverified
Surf at MEDIQA 2019: Improving Performance of Natural Language Inference in the Clinical Domain by Adopting Pre-trained Language Model	Jun 19, 2019	Language ModelingLanguage Modelling	—Unverified
基於特徵為本及使用SVM 的文本對蘊涵關係的自動推論方法 (Textual Entailment Recognition Using Textual Features and SVM) [In Chinese]	Oct 1, 2013	Natural Language Inference	—Unverified
SWAG: A Large-Scale Adversarial Dataset for Grounded Commonsense Inference	Aug 16, 2018	Common Sense ReasoningMultiple-choice	—Unverified
SWOW-8500: Word Association task for Intrinsic Evaluation of Word Embeddings	Jun 1, 2019	General ClassificationNatural Language Inference	—Unverified
SXUCFN-Core: STS Models Integrating FrameNet Parsing Information	Jun 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
SylloBio-NLI: Evaluating Large Language Models on Biomedical Syllogistic Reasoning	Oct 18, 2024	Natural Language Inferencescientific discovery	—Unverified
Synonym Acquisition Using Bilingual Comparable Corpora	Oct 1, 2013	Natural Language Inference	—Unverified
Syntax-based Attention Model for Natural Language Inference	Jul 22, 2016	modelNatural Language Inference	—Unverified
Systems' Agreements and Disagreements in Temporal Processing: An Extensive Error Analysis of the TempEval-3 Task	May 1, 2018	Natural Language InferenceQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 42 of 79Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B	Accuracy	92.5	—	Unverified
9	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
10	ST-MoE-L 4.1B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	DeBERTa (large)	Matched	91.1	—	Unverified
9	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified