Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1001–1050 of 1961 papers

Title	Date	Tasks	Status
Sexism Detection on a Data Diet	Jun 7, 2024	Natural Language Inference	—Unverified
SG-FSM: A Self-Guiding Zero-Shot Prompting Paradigm for Multi-Hop Question Answering Based on Finite State Machine	Oct 22, 2024	HallucinationMulti-hop Question Answering	—Unverified
SG-Net: Syntax Guided Transformer for Language Representation	Dec 27, 2020	Machine Reading ComprehensionMachine Translation	—Unverified
Siamese Networks for Inference in Malayalam Language Texts	Sep 1, 2021	Binary ClassificationClassification	—Unverified
Sieg at MEDIQA 2019: Multi-task Neural Ensemble for Biomedical Inference and Entailment	Aug 1, 2019	Multi-Task LearningNatural Language Inference	—Unverified
SIFiD: Reassess Summary Factual Inconsistency Detection with LLM	Mar 12, 2024	Natural Language InferenceSemantic Similarity	—Unverified
SimiHawk at SemEval-2016 Task 1: A Deep Ensemble System for Semantic Textual Similarity	Jun 1, 2016	Machine TranslationNatural Language Inference	—Unverified
Similarity and Farness Based Bidirectional Neural Co-Attention for Amharic Natural Language Inference	Jul 1, 2020	Natural Language Inference	—Unverified
Simple Yet Effective Synthetic Dataset Construction for Unsupervised Opinion Summarization	Mar 21, 2023	Natural Language InferenceOpinion Summarization	—Unverified
SIRIUS-LTG: An Entity Linking Approach to Fact Extraction and Verification	Nov 1, 2018	Entity LinkingInformation Retrieval	—Unverified
SMoA: Sparse Mixture of Adapters to Mitigate Multiple Dataset Biases	Feb 28, 2023	Adversarial RobustnessNatural Language Inference	—Unverified
So-Called Non-Subsective Adjectives	Aug 1, 2016	Natural Language Inference	—Unverified
SOFTCARDINALITY-CORE: Improving Text Overlap with Distributional Measures for Semantic Textual Similarity	Jun 1, 2013	Information RetrievalMachine Translation	—Unverified
SOFTCARDINALITY: Hierarchical Text Overlap for Student Response Analysis	Jun 1, 2013	Entity ResolutionInformation Retrieval	—Unverified
SOFTCARDINALITY: Learning to Identify Directional Cross-Lingual Entailment from Cardinalities and SMT	Jun 1, 2013	Machine TranslationNatural Language Inference	—Unverified
Soft Cardinality + ML: Learning Adaptive Similarity Functions for Cross-lingual Textual Entailment	Jul 1, 2012	Information RetrievalNatural Language Inference	—Unverified
Soft Label Memorization-Generalization for Natural Language Inference	Feb 27, 2017	MemorizationNatural Language Inference	—Unverified
Soft Layer Selection with Meta-Learning for Zero-Shot Cross-Lingual Transfer	Jul 21, 2021	Cross-Lingual Natural Language InferenceCross-Lingual Transfer	—Unverified
Spot the Odd Man Out: Exploring the Associative Power of Lexical Resources	Oct 1, 2018	ClusteringNatural Language Inference	—Unverified
SPred: Large-scale Harvesting of Semantic Predicates	Aug 1, 2013	Information RetrievalNatural Language Inference	—Unverified
Squibs: What Is a Paraphrase?	Jan 1, 2013	Machine TranslationNatural Language Inference	—Unverified
sranjans : Semantic Textual Similarity using Maximal Weighted Bipartite Graph Matching	Jul 1, 2012	Graph MatchingNatural Language Inference	—Unverified
SRIUBC: Simple Similarity Features for Semantic Textual Similarity	Jul 1, 2012	Natural Language InferenceParaphrase Identification	—Unverified
SSAS: Semantic Similarity for Abstractive Summarization	Nov 1, 2017	Abstractive Text SummarizationNatural Language Inference	—Unverified
Stanford: Probabilistic Edit Distance Metrics for STS	Jul 1, 2012	Machine TranslationNatural Language Inference	—Unverified
Stress Test Evaluation of Transformer-based Models in Natural Language Understanding Tasks	Feb 14, 2020	Natural Language InferenceNatural Language Understanding	—Unverified
Stress-Testing Neural Models of Natural Language Inference with Multiply-Quantified Sentences	Oct 30, 2018	Natural Language Inference	—Unverified
String Re-writing Kernel	Jul 1, 2012	Information RetrievalNatural Language Inference	—Unverified
Strong hallucinations from negation and how to fix them	Feb 16, 2024	Natural Language InferenceNegation	—Unverified
StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding	Aug 13, 2019	Language ModelingLanguage Modelling	—Unverified
Structural Representations for Learning Relations between Pairs of Texts	Jul 1, 2015	Feature EngineeringNatural Language Inference	—Unverified
STRUCTURED ALIGNMENT NETWORKS	Jan 1, 2018	Natural Language InferenceSentence	—Unverified
Structured Alignment Networks for Matching Sentences	Oct 1, 2018	Natural Language InferenceQuestion Answering	—Unverified
Structured Attention Networks	Feb 3, 2017	Machine TranslationNatural Language Inference	—Unverified
Structured Learning for Taxonomy Induction with Belief Propagation	Jun 1, 2014	Natural Language InferenceQuestion Answering	—Unverified
STS-UHH at SemEval-2017 Task 1: Scoring Semantic Textual Similarity Using Supervised and Unsupervised Ensemble	Aug 1, 2017	Graph SimilarityInformation Retrieval	—Unverified
Stubborn Lexical Bias in Data and Models	Jun 3, 2023	Natural Language Inference	—Unverified
Subword ELMo	Sep 18, 2019	Dependency ParsingNatural Language Inference	—Unverified
SufiSent - Universal Sentence Representations Using Suffix Encodings	Feb 20, 2018	Natural Language InferenceSentence	—Unverified
Supervised Distributional Hypernym Discovery via Domain Adaptation	Nov 1, 2016	ClusteringDomain Adaptation	—Unverified
Supervised Open Information Extraction	Jun 1, 2018	Knowledge Base PopulationNatural Language Inference	—Unverified
Surf at MEDIQA 2019: Improving Performance of Natural Language Inference in the Clinical Domain by Adopting Pre-trained Language Model	Jun 19, 2019	Language ModelingLanguage Modelling	—Unverified
基於特徵為本及使用SVM 的文本對蘊涵關係的自動推論方法 (Textual Entailment Recognition Using Textual Features and SVM) [In Chinese]	Oct 1, 2013	Natural Language Inference	—Unverified
SWAG: A Large-Scale Adversarial Dataset for Grounded Commonsense Inference	Aug 16, 2018	Common Sense ReasoningMultiple-choice	—Unverified
SWOW-8500: Word Association task for Intrinsic Evaluation of Word Embeddings	Jun 1, 2019	General ClassificationNatural Language Inference	—Unverified
SXUCFN-Core: STS Models Integrating FrameNet Parsing Information	Jun 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
SylloBio-NLI: Evaluating Large Language Models on Biomedical Syllogistic Reasoning	Oct 18, 2024	Natural Language Inferencescientific discovery	—Unverified
Synonym Acquisition Using Bilingual Comparable Corpora	Oct 1, 2013	Natural Language Inference	—Unverified
Syntax-based Attention Model for Natural Language Inference	Jul 22, 2016	modelNatural Language Inference	—Unverified
Systems' Agreements and Disagreements in Temporal Processing: An Extensive Error Analysis of the TempEval-3 Task	May 1, 2018	Natural Language InferenceQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 21 of 40Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
9	T5-XXL 11B	Accuracy	92.5	—	Unverified
10	UL2 20B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
9	DeBERTa (large)	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified