Natural Language Inference

Natural language inference (NLI) is the task of determining whether a "hypothesis" is true (entailment), false (contradiction), or undetermined (neutral) given a "premise".

Example:

| Premise | Label | Hypothesis | | --- | ---| --- | | A man inspects the uniform of a figure in some East Asian country. | contradiction | The man is sleeping. | | An older and younger man smiling. | neutral | Two men are smiling and laughing at the cats playing on the floor. | | A soccer game with multiple males playing. | entailment | Some men are playing a sport. |

Approaches used for NLI include earlier symbolic and statistical approaches to more recent deep learning approaches. Benchmark datasets used for NLI include SNLI, MultiNLI, SciTail, among others. You can get hands-on practice on the SNLI task by following this d2l.ai chapter.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1526–1550 of 1961 papers

Title	Date	Tasks	Status
Detecting Asymmetric Semantic Relations in Context: A Case-Study on Hypernymy Detection	Aug 1, 2017	Natural Language InferenceQuestion Answering	—Unverified
STS-UHH at SemEval-2017 Task 1: Scoring Semantic Textual Similarity Using Supervised and Unsupervised Ensemble	Aug 1, 2017	Graph SimilarityInformation Retrieval	—Unverified
The RepEval 2017 Shared Task: Multi-Genre Natural Language Inference with Sentence Representations	Jul 25, 2017	Natural Language InferenceRepresentation Learning	—Unverified
Character-level Intra Attention Network for Natural Language Inference	Jul 24, 2017	Natural Language InferenceSentence	CodeCode Available
Refining Raw Sentence Representations for Textual Entailment Recognition via Attention	Jul 11, 2017	General ClassificationNatural Language Inference	CodeCode Available
Learning to Compose Task-Specific Tree Structures	Jul 10, 2017	Natural Language InferenceSentiment Analysis	CodeCode Available
Evaluating Compound Splitters Extrinsically with Textual Entailment	Jul 1, 2017	Information RetrievalMachine Translation	—Unverified
RelTextRank: An Open Source Framework for Building Relational Syntactic-Semantic Text Pair Representations	Jul 1, 2017	Community Question AnsweringNatural Language Inference	—Unverified
TextFlow: A Text Similarity Measure based on Continuous Sequences	Jul 1, 2017	Natural Language InferencePosition	—Unverified
An Empirical Study on End-to-End Sentence Modelling	Jul 1, 2017	Natural Language InferenceSentence	—Unverified
A Monotonicity Calculus and Its Completeness	Jul 1, 2017	Natural Language Inference	—Unverified
Dynamic Integration of Background Knowledge in Neural NLU Systems	Jun 8, 2017	Common Sense ReasoningNatural Language Inference	—Unverified
Learning to Compute Word Embeddings On the Fly	Jun 1, 2017	Language ModelingLanguage Modelling	—Unverified
Max-Cosine Matching Based Neural Models for Recognizing Textual Entailment	May 25, 2017	Natural Language InferenceRTE	—Unverified
Jointly Learning Sentence Embeddings and Syntax with Unsupervised Tree-LSTMs	May 25, 2017	Natural Language InferenceReverse Dictionary	—Unverified
Second-Order Word Embeddings from Nearest Neighbor Topological Features	May 23, 2017	named-entity-recognitionNamed Entity Recognition	CodeCode Available
A Regularized Framework for Sparse and Structured Neural Attention	May 22, 2017	Machine TranslationNatural Language Inference	CodeCode Available
Baselines and test data for cross-lingual inference	Apr 18, 2017	Cross-Lingual Word EmbeddingsMachine Translation	CodeCode Available
Learning to Predict Denotational Probabilities For Modeling Entailment	Apr 1, 2017	Coreference ResolutionNatural Language Inference	—Unverified
Arabic Textual Entailment with Word Embeddings	Apr 1, 2017	Machine TranslationNatural Language Inference	—Unverified
How Well Can We Predict Hypernyms from Word Embeddings? A Dataset-Centric Analysis	Apr 1, 2017	Natural Language InferenceWord Embeddings	—Unverified
Annotating omission in statement pairs	Apr 1, 2017	Natural Language Inference	CodeCode Available
Integer Linear Programming formulations in Natural Language Processing	Apr 1, 2017	Dependency ParsingNatural Language Inference	—Unverified
Modelling metaphor with attribute-based semantics	Apr 1, 2017	AttributeMachine Translation	—Unverified
Social Bias in Elicited Natural Language Inferences	Apr 1, 2017	Language ModelingLanguage Modelling	CodeCode Available

Show:10 25 50

← PrevPage 62 of 79Next →

All datasets SNLI RTE MultiNLI QNLI ANLI test WNLI LiDiRus RCB TERRa CommitmentBank SciTail FarsTail

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	% Test Accuracy	94.7	—	Unverified
2	UnitedSynT5 (335M)	% Test Accuracy	93.5	—	Unverified
3	EFL (Entailment as Few-shot Learner) + RoBERTa-large	% Test Accuracy	93.1	—	Unverified
4	Neural Tree Indexers for Text Understanding	% Test Accuracy	93.1	—	Unverified
5	RoBERTa-large+Self-Explaining	% Test Accuracy	92.3	—	Unverified
6	RoBERTa-large + self-explaining layer	% Test Accuracy	92.3	—	Unverified
7	CA-MTL	% Test Accuracy	92.1	—	Unverified
8	SemBERT	% Test Accuracy	91.9	—	Unverified
9	MT-DNN-SMARTLARGEv0	% Test Accuracy	91.7	—	Unverified
10	MT-DNN-SMART_100%ofTrainingData	Dev Accuracy	91.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Vega v2 6B (KD-based prompt transfer)	Accuracy	96	—	Unverified
2	PaLM 540B (fine-tuned)	Accuracy	95.7	—	Unverified
3	Turing NLR v5 XXL 5.4B (fine-tuned)	Accuracy	94.1	—	Unverified
4	ST-MoE-32B 269B (fine-tuned)	Accuracy	93.5	—	Unverified
5	DeBERTa-1.5B	Accuracy	93.2	—	Unverified
6	MUPPET Roberta Large	Accuracy	92.8	—	Unverified
7	DeBERTaV3large	Accuracy	92.7	—	Unverified
8	T5-XXL 11B	Accuracy	92.5	—	Unverified
9	T5-XXL 11B (fine-tuned)	Accuracy	92.5	—	Unverified
10	ST-MoE-L 4.1B (fine-tuned)	Accuracy	92.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedSynT5 (3B)	Matched	92.6	—	Unverified
2	Turing NLR v5 XXL 5.4B (fine-tuned)	Matched	92.6	—	Unverified
3	T5-XXL 11B (fine-tuned)	Matched	92	—	Unverified
4	T5	Matched	92	—	Unverified
5	T5-11B	Mismatched	91.7	—	Unverified
6	T5-3B	Matched	91.4	—	Unverified
7	ALBERT	Matched	91.3	—	Unverified
8	DeBERTa (large)	Matched	91.1	—	Unverified
9	Adv-RoBERTa ensemble	Matched	91.1	—	Unverified
10	SMARTRoBERTa	Dev Matched	91.1	—	Unverified