Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1201–1250 of 1961 papers

Title	Date	Tasks	Status
Adversarial attacks against Fact Extraction and VERification	Mar 13, 2019	Fact CheckingInformation Retrieval	—Unverified
Adversarial Text Normalization	Jun 8, 2022	Adversarial TextNatural Language Inference	—Unverified
Adversarial Training for Large Neural Language Models	Apr 20, 2020	Natural Language InferenceNatural Language Understanding	—Unverified
A Fact Checking and Verification System for FEVEROUS Using a Zero-Shot Learning Approach	Nov 1, 2021	Fact CheckingNatural Language Inference	—Unverified
Affective Common Sense Knowledge Acquisition for Sentiment Analysis	May 1, 2012	Common Sense ReasoningDecision Making	—Unverified
A Formalism and Approach for Improving Robustness of Large Language Models Using Risk-Adjusted Confidence Scores	Oct 5, 2023	Natural Language Inference	—Unverified
A Generative Approach for Mitigating Structural Biases in Natural Language Inference	Nov 16, 2021	Natural Language Inference	—Unverified
A Generic NLI approach for Classification of Sentiment Associated with Therapies	Nov 28, 2023	ClassificationNatural Language Inference	—Unverified
Aggregated Word Pair Features for Implicit Discourse Relation Disambiguation	Aug 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
Aggregating Bidirectional Encoder Representations Using MatchLSTM for Sequence Matching	Nov 1, 2019	Natural Language InferencePosition	—Unverified
A guide to the dataset explosion in QA, NLI, and commonsense reasoning	Dec 1, 2020	Natural Language InferenceQuestion Answering	—Unverified
A hierarchical taxonomy for classifying hardness of inference tasks	May 1, 2014	coreference-resolutionCoreference Resolution	—Unverified
A Hybrid Approach for Deep Machine Translation	Oct 1, 2016	Machine TranslationNatural Language Inference	—Unverified
A Hybrid Approach to Generation of Missing Abstracts in Biomedical Literature	Dec 1, 2016	ArticlesInformation Retrieval	—Unverified
A Hybrid Neural Network Model for Commonsense Reasoning	Jul 27, 2019	Common Sense ReasoningCoreference Resolution	—Unverified
A Hybrid System to apply Natural Language Inference over Dependency Trees	Sep 1, 2017	Natural Language Inference	—Unverified
AIA-BDE: A Corpus of FAQs in Portuguese and their Variations	May 1, 2020	Information RetrievalNatural Language Inference	—Unverified
AI-KU: Using Co-Occurrence Modeling for Semantic Similarity	Aug 1, 2014	Information RetrievalLanguage Modelling	—Unverified
A Joint Training Framework for Open-World Knowledge Graph Embeddings	Jun 22, 2021	Dialogue GenerationEntity Embeddings	—Unverified
A Large Resource of Patterns for Verbal Paraphrases	May 1, 2018	Natural Language InferenceSemantic Textual Similarity	—Unverified
A Latent Discriminative Model for Compositional Entailment Relation Recognition using Natural Logic	Dec 1, 2012	Natural Language InferenceRelation	—Unverified
ALERT: Adapting Language Models to Reasoning Tasks	Dec 16, 2022	Few-Shot LearningLanguage Modeling	—Unverified
Alexa Teacher Model: Pretraining and Distilling Multi-Billion-Parameter Encoders for Natural Language Understanding Systems	Jun 15, 2022	Cross-Lingual Natural Language Inferenceintent-classification	—Unverified
A Lexicon-based Investigation of Research Issues in Japanese Factuality Analysis	Oct 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
A Lightweight and High Performance Monolingual Word Aligner	Aug 1, 2013	Machine TranslationNatural Language Inference	—Unverified
Align, Disambiguate and Walk: A Unified Approach for Measuring Semantic Similarity	Aug 1, 2013	Information RetrievalLexical Simplification	—Unverified
Aligning Predicate-Argument Structures for Paraphrase Fragment Extraction	May 1, 2014	Document SummarizationMachine Translation	—Unverified
Align, Mask and Select: A Simple Method for Incorporating Commonsense Knowledge into Language Representation Models	Aug 19, 2019	Common Sense ReasoningNatural Language Inference	—Unverified
Alignment Rationale for Natural Language Inference	Aug 1, 2021	feature selectionNatural Language Inference	—Unverified
A Linguistic Investigation of Machine Learning based Contradiction Detection Models: An Empirical Analysis and Future Perspectives	Oct 19, 2022	Natural Language Inference	—Unverified
A Logic-based Approach for Recognizing Textual Entailment Supported by Ontological Background Knowledge	Oct 18, 2013	Common Sense ReasoningNatural Language Inference	—Unverified
ALTN: Word Alignment Features for Cross-lingual Textual Entailment	Jun 1, 2013	Machine TranslationNatural Language Inference	—Unverified
ALVIN: Active Learning Via INterpolation	Oct 11, 2024	Active LearningNatural Language Inference	—Unverified
A memory enhanced LSTM for modeling complex temporal dependencies	Oct 25, 2019	Natural Language Inference	—Unverified
‘Am I the Bad One’? Predicting the Moral Judgement of the Crowd Using Pre–trained Language Models	Jun 1, 2022	Anomaly DetectionNatural Language Inference	—Unverified
A Monotonicity Calculus and Its Completeness	Jul 1, 2017	Natural Language Inference	—Unverified
A Morphology-Based Investigation of Positional Encodings	Apr 6, 2024	Dependency Parsingnamed-entity-recognition	—Unverified
A mostly unlexicalized model for recognizing textual entailment	Nov 1, 2018	Fake News DetectionInformation Retrieval	—Unverified
AMR Parsing with an Incremental Joint Model	Nov 1, 2016	Abstractive Text SummarizationAMR Parsing	—Unverified
A Multi-Domain Framework for Textual Similarity. A Case Study on Question-to-Question and Question-Answering Similarity Tasks	May 1, 2018	Community Question AnsweringNatural Language Inference	—Unverified
A Multi-level Supervised Contrastive Learning Framework for Low-Resource Natural Language Inference	May 31, 2022	Contrastive LearningData Augmentation	—Unverified
A Multilingual Perspective Towards the Evaluation of Attribution Methods	Jan 16, 2022	Natural Language Inference	—Unverified
An\'alise de Medidas de Similaridade Sem\^antica na Tarefa de Reconhecimento de Implica \~ao Textual (Analysis of Semantic Similarity Measures in the Recognition of Textual Entailment Task)[In Portuguese]	Oct 1, 2017	Natural Language InferenceSemantic Similarity	—Unverified
AnaLog: Testing Analytical and Deductive Logic Learnability in Language Models	Jul 1, 2022	Language ModelingLanguage Modelling	—Unverified
Analysis and Mitigation of Dataset Artifacts in OpenAI GPT-3	Dec 19, 2021	Natural Language Inference	—Unverified
Analysis of the Fed's communication by using textual entailment model of Zero-Shot classification	Jun 7, 2023	Natural Language InferenceSentiment Analysis	—Unverified
An Analysis of Natural Language Inference Benchmarks through the Lens of Negation	Nov 1, 2020	Natural Language InferenceNegation	—Unverified
An analysis of textual inference in German customer emails	Aug 1, 2014	Natural Language InferenceSemantic Textual Similarity	—Unverified
An Analysis under a Unified Fomulation of Learning Algorithms with Output Constraints	Jun 3, 2024	Continual LearningNatural Language Inference	—Unverified
An Empirical Analysis of Formality in Online Communication	Jan 1, 2016	Automatic WritingKnowledge Base Population	—Unverified

Show:10 25 50

← PrevPage 25 of 40Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B	Accuracy	92.5	—	Unverified
9	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
10	ST-MoE-L 4.1B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	DeBERTa (large)	Matched	91.1	—	Unverified
9	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified