Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2901–2925 of 10817 papers

Title	Date	Tasks	Status
Bridge Damage Cause Estimation Using Multiple Images Based on Visual Question Answering	Feb 18, 2023	Question AnsweringVisual Question Answering	—Unverified
Answering Science Exam Questions Using Query Reformulation with Background Knowledge	Nov 17, 2018	ARCInformation Retrieval	—Unverified
Answering Science Exam Questions Using Query Rewriting with Background Knowledge	Sep 15, 2018	ARCInformation Retrieval	—Unverified
Answering Questions Requiring Cross-passage Evidence	Nov 1, 2012	Information RetrievalQuestion Answering	—Unverified
Breaking Neural Network Scaling Laws with Modularity	Sep 9, 2024	Question AnsweringVisual Question Answering	—Unverified
Bridging the Language Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs	May 28, 2023	Question AnsweringRAG	—Unverified
Breaking Language Barriers: A Question Answering Dataset for Hindi and Marathi	Aug 19, 2023	Question Answering	—Unverified
Acquiring Predicate Paraphrases from News Tweets	Aug 1, 2017	Natural Language InferenceQuestion Answering	—Unverified
Enhancing Unsupervised Sentence Similarity Methods with Deep Contextualised Word Representations	Sep 1, 2019	Contextualised Word RepresentationsInformation Retrieval	—Unverified
Breaking Down Questions for Outside-Knowledge Visual Question Answering	Nov 16, 2021	Graph Neural NetworkQuestion Answering	—Unverified
Breaking Down Questions for Outside-Knowledge VQA	Sep 29, 2021	Graph Neural NetworkQuestion Answering	—Unverified
Breaking Common Sense: WHOOPS! A Vision-and-Language Benchmark of Synthetic and Compositional Images	Mar 13, 2023	Common Sense ReasoningExplanation Generation	—Unverified
Breaking Character: Are Subwords Good Enough for MRLs After All?	Apr 10, 2022	AllExtractive Question-Answering	—Unverified
Answering Questions from Multiple Documents -- the Role of Multi-Document Summarization	Sep 1, 2013	Abstractive Text SummarizationDocument Summarization	—Unverified
Aggregated Word Pair Features for Implicit Discourse Relation Disambiguation	Aug 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
Breaking Character: Are Subwords Good Enough for MRLs After All?	Jan 16, 2022	AllExtractive Question-Answering	—Unverified
Breadth First Reasoning Graph for Multi-hop Question Answering	Jun 1, 2021	Graph Neural NetworkMulti-hop Question Answering	—Unverified
Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM	Mar 12, 2024	Arithmetic ReasoningCode Generation	—Unverified
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models	Oct 24, 2024	Question AnsweringRAG	—Unverified
A2P-MANN: Adaptive Attention Inference Hops Pruned Memory-Augmented Neural Networks	Jan 24, 2021	CPUGPU	—Unverified
Enhancing Software-Related Information Extraction via Single-Choice Question Answering with Large Language Models	Apr 8, 2024	DescriptiveIn-Context Learning	—Unverified
BrainChat: Decoding Semantic Information from fMRI using Vision-language Pretrained Models	Jun 10, 2024	DecoderQuestion Answering	—Unverified
Brahmi-Net: A transliteration and script conversion system for languages of the Indian subcontinent	Jun 1, 2015	Information RetrievalMachine Translation	—Unverified
Answering Product-related Questions with Heterogeneous Information	Dec 1, 2020	AttributeQuestion Answering	—Unverified
BQA: Body Language Question Answering Dataset for Video Large Language Models	Oct 17, 2024	Question Answering	—Unverified

Show:10 25 50

← PrevPage 117 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified