Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2911–2920 of 10817 papers

Title	Date	Tasks	Status
Breaking Character: Are Subwords Good Enough for MRLs After All?	Apr 10, 2022	AllExtractive Question-Answering	—Unverified
Answering Questions from Multiple Documents -- the Role of Multi-Document Summarization	Sep 1, 2013	Abstractive Text SummarizationDocument Summarization	—Unverified
Aggregated Word Pair Features for Implicit Discourse Relation Disambiguation	Aug 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
Breaking Character: Are Subwords Good Enough for MRLs After All?	Jan 16, 2022	AllExtractive Question-Answering	—Unverified
Breadth First Reasoning Graph for Multi-hop Question Answering	Jun 1, 2021	Graph Neural NetworkMulti-hop Question Answering	—Unverified
Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM	Mar 12, 2024	Arithmetic ReasoningCode Generation	—Unverified
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models	Oct 24, 2024	Question AnsweringRAG	—Unverified
A2P-MANN: Adaptive Attention Inference Hops Pruned Memory-Augmented Neural Networks	Jan 24, 2021	CPUGPU	—Unverified
Enhancing Robustness of Retrieval-Augmented Language Models with In-Context Learning	Aug 8, 2024	In-Context LearningMachine Reading Comprehension	—Unverified
BrainChat: Decoding Semantic Information from fMRI using Vision-language Pretrained Models	Jun 10, 2024	DecoderQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 292 of 1082Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified