Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 7901–7950 of 10817 papers

Title	Date	Tasks	Status
Structured Knowledge Grounding for Question Answering	Sep 17, 2022	Knowledge GraphsOpen-Ended Question Answering	—Unverified
Question-to-Question Retrieval for Hallucination-Free Knowledge Access: An Approach for Wikipedia and Wikidata Question Answering	Jan 20, 2025	Answer GenerationComputational Efficiency	—Unverified
GPTs and Language Barrier: A Cross-Lingual Legal QA Examination	Mar 26, 2024	ArticlesBenchmarking	—Unverified
GPTR: Gestalt-Perception Transformer for Diagram Object Detection	Dec 29, 2022	DecoderObject	—Unverified
CompMix: A Benchmark for Heterogeneous Question Answering	Jun 21, 2023	Question Answering	—Unverified
Flexible Frame Selection for Efficient Video Reasoning	Jan 1, 2025	Language ModelingLanguage Modelling	—Unverified
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation	Nov 25, 2023	Instruction FollowingLanguage Modeling	—Unverified
GPT-4V Explorations: Mining Autonomous Driving	Jun 24, 2024	Autonomous DrivingDecision Making	—Unverified
GPT4GEO: How a Language Model Sees the World's Geography	May 30, 2023	Disaster ResponseLanguage Modeling	—Unverified
QU-IR at SemEval 2016 Task 3: Learning to Rank on Arabic Community Question Answering Forums with Word Embedding	Jun 1, 2016	Community Question AnsweringLearning-To-Rank	—Unverified
A Stacking Gated Neural Architecture for Implicit Discourse Relation Classification	Nov 1, 2016	Feature EngineeringGeneral Classification	—Unverified
QUITO-X: A New Perspective on Context Compression from the Information Bottleneck Theory	Aug 20, 2024	In-Context LearningQuestion Answering	—Unverified
QuOTE: Question-Oriented Text Embeddings	Feb 16, 2025	Multi-hop Question AnsweringQuestion Answering	—Unverified
QurAna: Corpus of the Quran annotated with Pronominal Anaphora	May 1, 2012	Coreference ResolutionInformation Retrieval	—Unverified
A Causal Approach to Mitigate Modality Preference Bias in Medical Visual Question Answering	May 22, 2025	counterfactualMedical Visual Question Answering	—Unverified
Reasoning-Driven Question-Answering for Natural Language Understanding	Aug 14, 2019	Common Sense ReasoningNatural Language Inference	—Unverified
Gpt-4: A Review on Advancements and Opportunities in Natural Language Processing	May 4, 2023	Language ModelingLanguage Modelling	—Unverified
GPT-3 Models are Few-Shot Financial Reasoners	Jul 25, 2023	Financial AnalysisPrompt Engineering	—Unverified
R2GQA: Retriever-Reader-Generator Question Answering System to Support Students Understanding Legal Regulations in Higher Education	Sep 4, 2024	ArticlesInformation Retrieval	—Unverified
R3: A Reading Comprehension Benchmark Requiring Reasoning Processes	Apr 2, 2020	Question AnsweringReading Comprehension	—Unverified
R3 : Refined Retriever-Reader pipeline for Multidoc2dial	May 1, 2022	Conversational Question AnsweringDecoder	—Unverified
FlowVQA: Mapping Multimodal Logic in Visual Question Answering with Flowcharts	Jun 27, 2024	Decision MakingLogical Reasoning	—Unverified
R4: Reinforced Retriever-Reorder-Responder for Retrieval-Augmented Large Language Models	May 4, 2024	Graph AttentionHallucination	—Unverified
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training	Oct 18, 2024	DenoisingQuestion Answering	—Unverified
GOVERN: Gradient Orientation Vote Ensemble for Multi-Teacher Reinforced Distillation	May 6, 2024	Knowledge DistillationQuestion Answering	—Unverified
Raccoons at SemEval-2022 Task 11: Leveraging Concatenated Word Embeddings for Named Entity Recognition	Jul 1, 2022	Machine Translationnamed-entity-recognition	—Unverified
Complex Question Answering: Unsupervised Learning Approaches and Experiments	Jan 15, 2014	Document SummarizationMulti-Document Summarization	—Unverified
RA-DIT: Retrieval-Augmented Dual Instruction Tuning	Oct 2, 2023	Few-Shot LearningOpen-Domain Question Answering	—Unverified
RadQA: A Question Answering Dataset to Improve Comprehension of Radiology Reports	Jun 1, 2022	Question AnsweringReading Comprehension	—Unverified
AssistPDA: An Online Video Surveillance Assistant for Video Anomaly Prediction, Detection, and Analysis	Mar 27, 2025	Anomaly DetectionAnomaly Forecasting	—Unverified
Assistive Image Annotation Systems with Deep Learning and Natural Language Capabilities: A Review	Jun 28, 2024	Active LearningImage Captioning	—Unverified
RAG based Question-Answering for Contextual Response Prediction System	Sep 5, 2024	PredictionQuestion Answering	—Unverified
RAG-based Question Answering over Heterogeneous Data and Text	Dec 10, 2024	Answer GenerationKnowledge Graphs	—Unverified
Topic-FlipRAG: Topic-Orientated Adversarial Opinion Manipulation Attacks to Retrieval-Augmented Generation Models	Feb 3, 2025	Question AnsweringRAG	—Unverified
GoT-CQA: Graph-of-Thought Guided Compositional Reasoning for Chart Question Answering	Sep 4, 2024	Chart Question AnsweringQuestion Answering	—Unverified
Goodwill Hunting: Analyzing and Repurposing Off-the-Shelf Named Entity Linking Systems	Jun 1, 2021	Entity LinkingQuestion Answering	—Unverified
Complex Question Answering on knowledge graphs using machine translation and multi-task learning	Apr 1, 2021	Entity LinkingKnowledge Graphs	—Unverified
Good, Great, Excellent: Global Inference of Semantic Intensities	Jan 1, 2013	Natural Language InferenceQuestion Answering	—Unverified
RAG-RL: Advancing Retrieval-Augmented Generation via RL and Curriculum Learning	Mar 17, 2025	Answer GenerationMulti-hop Question Answering	—Unverified
FOCUS: Internal MLLM Representations for Efficient Fine-Grained Visual Question Answering	Jun 25, 2025	Question AnsweringVisual Question Answering	—Unverified
RAG vs. GraphRAG: A Systematic Evaluation and Key Insights	Feb 17, 2025	Knowledge GraphsQuestion Answering	—Unverified
Examining Long-Context Large Language Models for Environmental Review Document Comprehension	Jul 10, 2024	Question AnsweringRAG	—Unverified
Complex QA and language models hybrid architectures, Survey	Feb 17, 2023	Domain AdaptationFairness	—Unverified
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts	Feb 26, 2024	DiversityQuestion Answering	—Unverified
Reasoning and Tools for Human-Level Forecasting	Aug 21, 2024	Decision MakingQuestion Answering	—Unverified
Good, Better, Best: Textual Distractors Generation for Multiple-Choice Visual Question Answering via Reinforcement Learning	Oct 21, 2019	Data AugmentationDecision Making	—Unverified
Complex Program Induction for Querying Knowledge Bases in the Absence of Gold Programs	Mar 1, 2019	Natural Language QueriesProgram induction	—Unverified
GOF at Qur’an QA 2022: Towards an Efficient Question Answering For The Holy Qu’ran In The Arabic Language Using Deep Learning-Based Approach	Jun 1, 2022	Question Answering	—Unverified
FONDUE: A Framework for Node Disambiguation Using Network Embeddings	Feb 24, 2020	Knowledge GraphsNetwork Embedding	—Unverified
Assisting Scene Graph Generation with Self-Supervision	Aug 8, 2020	Graph GenerationImage Captioning	—Unverified

Show:10 25 50

← PrevPage 159 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified