Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1501–1550 of 1961 papers

Title	Date	Tasks	Status
Recognizing Textual Entailment in Twitter Using Word Embeddings	Sep 1, 2017	Information RetrievalMachine Translation	—Unverified
Identifying Semantic Edit Intentions from Revisions in Wikipedia	Sep 1, 2017	ArticlesInformation Retrieval	—Unverified
LCT-MALTA's Submission to RepEval 2017 Shared Task	Sep 1, 2017	Natural Language InferencePOS	—Unverified
Detecting Metaphorical Phrases in the Polish Language	Sep 1, 2017	Machine TranslationNatural Language Inference	—Unverified
TAG Parser Evaluation using Textual Entailments	Sep 1, 2017	Natural Language InferenceTAG	—Unverified
Neural Paraphrase Generation using Transfer Learning	Sep 1, 2017	Machine TranslationNatural Language Inference	—Unverified
Visual Denotations for Recognizing Textual Entailment	Sep 1, 2017	Natural Language InferenceSemantic Composition	—Unverified
Applying Deep Neural Network to Retrieve Relevant Civil Law Articles	Sep 1, 2017	ArticlesClustering	—Unverified
deepCybErNet at EmoInt-2017: Deep Emotion Intensities in Tweets	Sep 1, 2017	Emotion ClassificationNatural Language Inference	—Unverified
Towards Improving Abstractive Summarization via Entailment Generation	Sep 1, 2017	Abstractive Text SummarizationDecoder	—Unverified
A Hybrid System to apply Natural Language Inference over Dependency Trees	Sep 1, 2017	Natural Language Inference	—Unverified
Using English Dictionaries to generate Commonsense Knowledge in Natural Language	Sep 1, 2017	Common Sense ReasoningNatural Language Inference	—Unverified
Inter-Weighted Alignment Network for Sentence Pair Modeling	Sep 1, 2017	Machine TranslationNatural Language Inference	—Unverified
Evaluating Hierarchies of Verb Argument Structure with Hierarchical Clustering	Sep 1, 2017	ClusteringLanguage Acquisition	—Unverified
Graph-Based Approach to Recognizing CST Relations in Polish Texts	Sep 1, 2017	Document SummarizationGraph Similarity	—Unverified
UDLex: Towards Cross-language Subcategorization Lexicons	Sep 1, 2017	Information RetrievalMachine Translation	—Unverified
Shortcut-Stacked Sentence Encoders for Multi-Domain Inference	Aug 7, 2017	Natural Language InferenceSentence	CodeCode Available
Recurrent Neural Network-Based Sentence Encoder with Gated Attention for Natural Language Inference	Aug 4, 2017	Natural Language InferenceNatural Language Understanding	CodeCode Available
Generating Pattern-Based Entailment Graphs for Relation Extraction	Aug 1, 2017	Knowledge Base PopulationNatural Language Inference	—Unverified
SemEval-2017 Task 1: Semantic Textual Similarity Multilingual and Crosslingual Focused Evaluation	Aug 1, 2017	Machine TranslationNatural Language Inference	—Unverified
MITRE at SemEval-2017 Task 1: Simple Semantic Similarity	Aug 1, 2017	BIG-bench Machine LearningImage Captioning	—Unverified
Prediction of Frame-to-Frame Relations in the FrameNet Hierarchy with Frame Embeddings	Aug 1, 2017	Natural Language InferenceRepresentation Learning	—Unverified
Detecting Cross-Lingual Semantic Divergence for Neural Machine Translation	Aug 1, 2017	Domain AdaptationMachine Translation	—Unverified
Acquiring Predicate Paraphrases from News Tweets	Aug 1, 2017	Natural Language InferenceQuestion Answering	—Unverified
The Event StoryLine Corpus: A New Benchmark for Causal and Temporal Relation Extraction	Aug 1, 2017	Natural Language InferenceQuestion Answering	—Unverified
Detecting Asymmetric Semantic Relations in Context: A Case-Study on Hypernymy Detection	Aug 1, 2017	Natural Language InferenceQuestion Answering	—Unverified
STS-UHH at SemEval-2017 Task 1: Scoring Semantic Textual Similarity Using Supervised and Unsupervised Ensemble	Aug 1, 2017	Graph SimilarityInformation Retrieval	—Unverified
The RepEval 2017 Shared Task: Multi-Genre Natural Language Inference with Sentence Representations	Jul 25, 2017	Natural Language InferenceRepresentation Learning	—Unverified
Character-level Intra Attention Network for Natural Language Inference	Jul 24, 2017	Natural Language InferenceSentence	CodeCode Available
Refining Raw Sentence Representations for Textual Entailment Recognition via Attention	Jul 11, 2017	General ClassificationNatural Language Inference	CodeCode Available
Learning to Compose Task-Specific Tree Structures	Jul 10, 2017	Natural Language InferenceSentiment Analysis	CodeCode Available
Evaluating Compound Splitters Extrinsically with Textual Entailment	Jul 1, 2017	Information RetrievalMachine Translation	—Unverified
RelTextRank: An Open Source Framework for Building Relational Syntactic-Semantic Text Pair Representations	Jul 1, 2017	Community Question AnsweringNatural Language Inference	—Unverified
TextFlow: A Text Similarity Measure based on Continuous Sequences	Jul 1, 2017	Natural Language InferencePosition	—Unverified
An Empirical Study on End-to-End Sentence Modelling	Jul 1, 2017	Natural Language InferenceSentence	—Unverified
A Monotonicity Calculus and Its Completeness	Jul 1, 2017	Natural Language Inference	—Unverified
Dynamic Integration of Background Knowledge in Neural NLU Systems	Jun 8, 2017	Common Sense ReasoningNatural Language Inference	—Unverified
Learning to Compute Word Embeddings On the Fly	Jun 1, 2017	Language ModelingLanguage Modelling	—Unverified
Max-Cosine Matching Based Neural Models for Recognizing Textual Entailment	May 25, 2017	Natural Language InferenceRTE	—Unverified
Jointly Learning Sentence Embeddings and Syntax with Unsupervised Tree-LSTMs	May 25, 2017	Natural Language InferenceReverse Dictionary	—Unverified
Second-Order Word Embeddings from Nearest Neighbor Topological Features	May 23, 2017	named-entity-recognitionNamed Entity Recognition	CodeCode Available
A Regularized Framework for Sparse and Structured Neural Attention	May 22, 2017	Machine TranslationNatural Language Inference	CodeCode Available
Baselines and test data for cross-lingual inference	Apr 18, 2017	Cross-Lingual Word EmbeddingsMachine Translation	CodeCode Available
Learning to Predict Denotational Probabilities For Modeling Entailment	Apr 1, 2017	Coreference ResolutionNatural Language Inference	—Unverified
Arabic Textual Entailment with Word Embeddings	Apr 1, 2017	Machine TranslationNatural Language Inference	—Unverified
How Well Can We Predict Hypernyms from Word Embeddings? A Dataset-Centric Analysis	Apr 1, 2017	Natural Language InferenceWord Embeddings	—Unverified
Annotating omission in statement pairs	Apr 1, 2017	Natural Language Inference	CodeCode Available
Integer Linear Programming formulations in Natural Language Processing	Apr 1, 2017	Dependency ParsingNatural Language Inference	—Unverified
Modelling metaphor with attribute-based semantics	Apr 1, 2017	AttributeMachine Translation	—Unverified
Social Bias in Elicited Natural Language Inferences	Apr 1, 2017	Language ModelingLanguage Modelling	CodeCode Available

Show:10 25 50

← PrevPage 31 of 40Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B	Accuracy	92.5	—	Unverified
9	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
10	ST-MoE-L 4.1B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	DeBERTa (large)	Matched	91.1	—	Unverified
9	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified