Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 951–1000 of 1961 papers

Title	Date	Tasks	Status
SIRIUS-LTG: An Entity Linking Approach to Fact Extraction and Verification	Nov 1, 2018	Entity LinkingInformation Retrieval	—Unverified
SMoA: Sparse Mixture of Adapters to Mitigate Multiple Dataset Biases	Feb 28, 2023	Adversarial RobustnessNatural Language Inference	—Unverified
So-Called Non-Subsective Adjectives	Aug 1, 2016	Natural Language Inference	—Unverified
SOFTCARDINALITY-CORE: Improving Text Overlap with Distributional Measures for Semantic Textual Similarity	Jun 1, 2013	Information RetrievalMachine Translation	—Unverified
SOFTCARDINALITY: Hierarchical Text Overlap for Student Response Analysis	Jun 1, 2013	Entity ResolutionInformation Retrieval	—Unverified
SOFTCARDINALITY: Learning to Identify Directional Cross-Lingual Entailment from Cardinalities and SMT	Jun 1, 2013	Machine TranslationNatural Language Inference	—Unverified
Soft Cardinality + ML: Learning Adaptive Similarity Functions for Cross-lingual Textual Entailment	Jul 1, 2012	Information RetrievalNatural Language Inference	—Unverified
Soft Label Memorization-Generalization for Natural Language Inference	Feb 27, 2017	MemorizationNatural Language Inference	—Unverified
Soft Layer Selection with Meta-Learning for Zero-Shot Cross-Lingual Transfer	Jul 21, 2021	Cross-Lingual Natural Language InferenceCross-Lingual Transfer	—Unverified
Spot the Odd Man Out: Exploring the Associative Power of Lexical Resources	Oct 1, 2018	ClusteringNatural Language Inference	—Unverified
SPred: Large-scale Harvesting of Semantic Predicates	Aug 1, 2013	Information RetrievalNatural Language Inference	—Unverified
Squibs: What Is a Paraphrase?	Jan 1, 2013	Machine TranslationNatural Language Inference	—Unverified
sranjans : Semantic Textual Similarity using Maximal Weighted Bipartite Graph Matching	Jul 1, 2012	Graph MatchingNatural Language Inference	—Unverified
SRIUBC: Simple Similarity Features for Semantic Textual Similarity	Jul 1, 2012	Natural Language InferenceParaphrase Identification	—Unverified
SSAS: Semantic Similarity for Abstractive Summarization	Nov 1, 2017	Abstractive Text SummarizationNatural Language Inference	—Unverified
Stanford: Probabilistic Edit Distance Metrics for STS	Jul 1, 2012	Machine TranslationNatural Language Inference	—Unverified
Stress Test Evaluation of Transformer-based Models in Natural Language Understanding Tasks	Feb 14, 2020	Natural Language InferenceNatural Language Understanding	—Unverified
Stress-Testing Neural Models of Natural Language Inference with Multiply-Quantified Sentences	Oct 30, 2018	Natural Language Inference	—Unverified
String Re-writing Kernel	Jul 1, 2012	Information RetrievalNatural Language Inference	—Unverified
Strong hallucinations from negation and how to fix them	Feb 16, 2024	Natural Language InferenceNegation	—Unverified
StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding	Aug 13, 2019	Language ModelingLanguage Modelling	—Unverified
Structural Representations for Learning Relations between Pairs of Texts	Jul 1, 2015	Feature EngineeringNatural Language Inference	—Unverified
STRUCTURED ALIGNMENT NETWORKS	Jan 1, 2018	Natural Language InferenceSentence	—Unverified
Structured Alignment Networks for Matching Sentences	Oct 1, 2018	Natural Language InferenceQuestion Answering	—Unverified
Structured Attention Networks	Feb 3, 2017	Machine TranslationNatural Language Inference	—Unverified
Structured Learning for Taxonomy Induction with Belief Propagation	Jun 1, 2014	Natural Language InferenceQuestion Answering	—Unverified
STS-UHH at SemEval-2017 Task 1: Scoring Semantic Textual Similarity Using Supervised and Unsupervised Ensemble	Aug 1, 2017	Graph SimilarityInformation Retrieval	—Unverified
Stubborn Lexical Bias in Data and Models	Jun 3, 2023	Natural Language Inference	—Unverified
Subword ELMo	Sep 18, 2019	Dependency ParsingNatural Language Inference	—Unverified
SufiSent - Universal Sentence Representations Using Suffix Encodings	Feb 20, 2018	Natural Language InferenceSentence	—Unverified
Supervised Distributional Hypernym Discovery via Domain Adaptation	Nov 1, 2016	ClusteringDomain Adaptation	—Unverified
Supervised Open Information Extraction	Jun 1, 2018	Knowledge Base PopulationNatural Language Inference	—Unverified
Surf at MEDIQA 2019: Improving Performance of Natural Language Inference in the Clinical Domain by Adopting Pre-trained Language Model	Jun 19, 2019	Language ModelingLanguage Modelling	—Unverified
基於特徵為本及使用SVM 的文本對蘊涵關係的自動推論方法 (Textual Entailment Recognition Using Textual Features and SVM) [In Chinese]	Oct 1, 2013	Natural Language Inference	—Unverified
SWAG: A Large-Scale Adversarial Dataset for Grounded Commonsense Inference	Aug 16, 2018	Common Sense ReasoningMultiple-choice	—Unverified
SWOW-8500: Word Association task for Intrinsic Evaluation of Word Embeddings	Jun 1, 2019	General ClassificationNatural Language Inference	—Unverified
SXUCFN-Core: STS Models Integrating FrameNet Parsing Information	Jun 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
SylloBio-NLI: Evaluating Large Language Models on Biomedical Syllogistic Reasoning	Oct 18, 2024	Natural Language Inferencescientific discovery	—Unverified
Synonym Acquisition Using Bilingual Comparable Corpora	Oct 1, 2013	Natural Language Inference	—Unverified
Syntax-based Attention Model for Natural Language Inference	Jul 22, 2016	modelNatural Language Inference	—Unverified
Systems' Agreements and Disagreements in Temporal Processing: An Extensive Error Analysis of the TempEval-3 Task	May 1, 2018	Natural Language InferenceQuestion Answering	—Unverified
TAG Parser Evaluation using Textual Entailments	Sep 1, 2017	Natural Language InferenceTAG	—Unverified
Tailor: Generating and Perturbing Text with Semantic Controls	Aug 17, 2021	Data AugmentationNatural Language Inference	—Unverified
TakeLab at SemEval-2018 Task12: Argument Reasoning Comprehension with Skip-Thought Vectors	Jun 1, 2018	Common Sense ReasoningNatural Language Inference	—Unverified
Taking into account Inter-sentence Similarity for Update Summarization	Nov 1, 2017	Document SummarizationExtractive Summarization	—Unverified
Talking with the Theorem Prover to Interactively Solve Natural Language Inference	Nov 1, 2021	Natural Language Inference	—Unverified
TALN-UPF: Taxonomy Learning Exploiting CRF-Based Hypernym Extraction on Encyclopedic Definitions	Jun 1, 2015	Natural Language InferenceQuestion Answering	—Unverified
Targeted Data Generation: Finding and Fixing Model Weaknesses	May 28, 2023	Data AugmentationNatural Language Inference	—Unverified
Task-adaptive Pre-training and Self-training are Complementary for Natural Language Understanding	Sep 14, 2021	named-entity-recognitionNamed Entity Recognition	—Unverified
Task-Specific Attentive Pooling of Phrase Alignments Contributes to Sentence Matching	Jan 9, 2017	Answer SelectionNatural Language Inference	—Unverified

Show:10 25 50

← PrevPage 20 of 40Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B	Accuracy	92.5	—	Unverified
9	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
10	ST-MoE-L 4.1B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	DeBERTa (large)	Matched	91.1	—	Unverified
9	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified