Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 7801–7825 of 10817 papers

Title	Date	Tasks	Status
Question Answering based Clinical Text Structuring Using Pre-trained Language Model	Aug 19, 2019	Language ModelingLanguage Modelling	—Unverified
Question-Answering Based Summarization of Electronic Health Records using Retrieval Augmented Generation	Jan 3, 2024	DiversityHallucination	—Unverified
Gradient-guided Attention Map Editing: Towards Efficient Contextual Hallucination Mitigation	Mar 11, 2025	Computational EfficiencyHallucination	—Unverified
GRADE: Quantifying Sample Diversity in Text-to-Image Models	Oct 29, 2024	AttributeDiversity	—Unverified
FINET: Context-Aware Fine-Grained Named Entity Typing	Sep 1, 2015	Entity TypingOpen Information Extraction	—Unverified
Question Answering for Complex Electronic Health Records Database using Unified Encoder-Decoder Architecture	Nov 14, 2021	DecoderNatural Questions	—Unverified
Component Analysis for Visual Question Answering Architectures	Feb 12, 2020	Question AnsweringRepresentation Learning	—Unverified
ComPO: Community Preferences for Language Model Personalization	Oct 21, 2024	DiversityLanguage Modeling	—Unverified
A State-transition Framework to Answer Complex Questions over Knowledge Base	Oct 1, 2018	Knowledge GraphsQuestion Answering	—Unverified
Question Answering from Unstructured Text by Retrieval and Comprehension	Mar 26, 2017	ArticlesOpen-Domain Question Answering	—Unverified
A Memory Model for Question Answering from Streaming Data Supported by Rehearsal and Anticipation of Coreference Information	May 12, 2023	MemorizationQuestion Answering	—Unverified
Question Relatedness on Stack Overflow: The Task, Dataset, and Corpus-inspired Models	May 3, 2019	Community Question AnsweringMulti-class Classification	—Unverified
Question Answering in Natural Language: the Special Case of Temporal Expressions	Nov 23, 2023	Question Answering	—Unverified
Question Answering in the Biomedical Domain	Jul 1, 2019	Question Answering	—Unverified
GPTs and Language Barrier: A Cross-Lingual Legal QA Examination	Mar 26, 2024	ArticlesBenchmarking	—Unverified
Question-Answering Model for Schizophrenia Symptoms and Their Impact on Daily Life using Mental Health Forums Data	Sep 30, 2023	Question Answering	—Unverified
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty	Sep 18, 2024	Decision MakingQuestion Answering	—Unverified
Question Answering on Knowledge Bases and Text using Universal Schema and Memory Networks	Apr 27, 2017	Question Answering	—Unverified
Question Answering on Linked Data: Challenges and Future Directions	Feb 16, 2016	Question Answering	—Unverified
Question Answering on Patient Medical Records with Private Fine-Tuned LLMs	Jan 23, 2025	Question Answering	—Unverified
Question Answering on Scholarly Knowledge Graphs	Jun 2, 2020	ArticlesKnowledge Base Question Answering	—Unverified
Question Answering Over Biological Knowledge Graph via Amazon Alexa	Oct 12, 2022	ArticlesData Integration	—Unverified
Question Answering over Curated and Open Web Sources	Apr 24, 2020	Information RetrievalKnowledge Graphs	—Unverified
GPTR: Gestalt-Perception Transformer for Diagram Object Detection	Dec 29, 2022	DecoderObject	—Unverified
CompMix: A Benchmark for Heterogeneous Question Answering	Jun 21, 2023	Question Answering	—Unverified

Show:10 25 50

← PrevPage 313 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified