Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 4426–4450 of 10817 papers

Title	Date	Tasks	Status
Around the GLOBE: Numerical Aggregation Question-Answering on Heterogeneous Genealogical Knowledge Graphs with Deep Neural Networks	Jul 30, 2023	Dataset GenerationKnowledge Graphs	—Unverified
Adapting Large Language Models to Domains via Reading Comprehension	Sep 18, 2023	Language ModelingLanguage Modelling	—Unverified
A Biomedical Question Answering System in BioASQ 2017	Aug 1, 2017	Question Answering	—Unverified
FilterRAG: Zero-Shot Informed Retrieval-Augmented Generation to Mitigate Hallucinations in VQA	Feb 25, 2025	Question AnsweringRetrieval	—Unverified
CICBUAPnlp: Graph-Based Approach for Answer Selection in Community Question Answering Task	Jun 1, 2015	Answer SelectionCommunity Question Answering	—Unverified
CIC: A Framework for Culturally-Aware Image Captioning	Feb 8, 2024	DescriptiveImage Captioning	—Unverified
A Robustly Optimized BERT Pre-training Approach with Post-training	Aug 1, 2021	Extractive Question-AnsweringQuestion Answering	—Unverified
Fill-in-the-Blank: A Challenging Video Understanding Evaluation Framework	Nov 16, 2021	Multiple-choiceQuestion Answering	—Unverified
Filling a Knowledge Graph with a Crowd	Dec 1, 2016	Knowledge GraphsQuestion Answering	—Unverified
FiE: Building a Global Probability Space by Leveraging Early Fusion in Encoder for Open-Domain Question Answering	Nov 18, 2022	Data AugmentationDecoder	—Unverified
A Road-map Towards Explainable Question Answering A Solution for Information Pollution	Jul 4, 2019	PositionQuestion Answering	—Unverified
FiDO: Fusion-in-Decoder optimized for stronger performance and faster inference	Dec 15, 2022	DecoderLanguage Modeling	—Unverified
FiD-Ex: Improving Sequence-to-Sequence Models for Extractive Rationale Generation	Dec 31, 2020	DecoderFact Verification	—Unverified
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering	May 22, 2024	Common Sense ReasoningGraph Question Answering	—Unverified
CHOPT : Automated Hyperparameter Optimization Framework for Cloud-Based Machine Learning Platforms	Oct 8, 2018	BIG-bench Machine LearningHyperparameter Optimization	—Unverified
FFA Sora, video generation as fundus fluorescein angiography simulator	Dec 23, 2024	Privacy PreservingQuestion Answering	—Unverified
Few-Shot VQA with Frozen LLMs: A Tale of Two Approaches	Mar 17, 2024	Image CaptioningQuestion Answering	—Unverified
Few-shot Unified Question Answering: Tuning Models or Prompts?	May 23, 2023	Question AnsweringTransfer Learning	—Unverified
Chop Chop BERT: Visual Question Answering by Chopping VisualBERT's Heads	Apr 30, 2021	Question AnsweringVisual Question Answering	—Unverified
Choosing which to use? A study of distributional models for nominal lexical semantic classification	May 1, 2014	General ClassificationMachine Translation	—Unverified
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation	Apr 3, 2025	Domain GeneralizationQuestion Answering	—Unverified
Few-shot Question Generation for Personalized Feedback in Intelligent Tutoring Systems	Jun 8, 2022	Generative Question AnsweringQuestion Answering	—Unverified
Few-shot Query-Focused Summarization with Prefix-Merging	Nov 29, 2022	Few-Shot LearningQuery-focused Summarization	—Unverified
Choose Your QA Model Wisely: A Systematic Study of Generative and Extractive Readers for Question Answering	Mar 14, 2022	DecoderDomain Generalization	—Unverified
Few-shot Policy (de)composition in Conversational Question Answering	Jan 20, 2025	Conversational Question AnsweringQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 178 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified