Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 7101–7150 of 10817 papers

Title	Date	Tasks	Status
Evidence-Enhanced Triplet Generation Framework for Hallucination Alleviation in Generative Question Answering	Aug 27, 2024	Generative Question AnsweringHallucination	—Unverified
Exploring the Robustness of Language Models for Tabular Question Answering via Attention Analysis	Jun 18, 2024	In-Context LearningQuestion Answering	—Unverified
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation	Jun 2, 2025	Multiple-choiceQuestion Answering	—Unverified
Accelerating Manufacturing Scale-Up from Material Discovery Using Agentic Web Navigation and Retrieval-Augmented AI for Process Engineering Schematics Design	Dec 8, 2024	Knowledge GraphsOpen-Domain Question Answering	—Unverified
Handling Multiword Expressions in Causality Estimation	Jan 1, 2017	Common Sense ReasoningQuestion Answering	—Unverified
Handling Anomalies of Synthetic Questions in Unsupervised Question Answering	Dec 1, 2020	Question Answering	—Unverified
Hand in Glove: Deep Feature Fusion Network Architectures for Answer Quality Prediction in Community Question Answering	Dec 1, 2016	Community Question AnsweringQuestion Answering	—Unverified
On the Transferability of Minimal Prediction Preserving Inputs in Question Answering	Sep 17, 2020	Adversarial RobustnessQuestion Answering	—Unverified
HAMMR: HierArchical MultiModal React agents for generic VQA	Apr 8, 2024	Optical Character Recognition (OCR)Question Answering	—Unverified
On the Value of Out-of-Distribution Testing: An Example of Goodhart's Law	May 19, 2020	Model SelectionQuestion Answering	—Unverified
A Supervised Approach for Enriching the Relational Structure of Frame Semantics in FrameNet	Dec 1, 2016	Coreference ResolutionQuestion Answering	—Unverified
OntoLearn Reloaded: A Graph-Based Algorithm for Taxonomy Induction	Jan 1, 2013	Information RetrievalQuestion Answering	—Unverified
Ontologically Grounded Multi-sense Representation Learning for Semantic Vector Space Models	May 1, 2015	Information RetrievalQuestion Answering	—Unverified
Ontology-Aware RAG for Improved Question-Answering in Cybersecurity Education	Dec 10, 2024	Question AnsweringRAG	—Unverified
Ontology-based and User-focused Automatic Text Summarization (OATS): Using COVID-19 Risk Factors as an Example	Nov 18, 2020	Question AnsweringText Summarization	—Unverified
Ontology-based question answering over corporate structured data	Nov 8, 2021	Natural Language UnderstandingQuestion Answering	—Unverified
Ontology-Based Retrieval \& Neural Approaches for BioASQ Ideal Answer Generation	Nov 1, 2018	Abstractive Text SummarizationAnswer Generation	—Unverified
EvolveSearch: An Iterative Self-Evolving Search Agent	May 28, 2025	Multi-hop Question AnsweringQuestion Answering	—Unverified
Ontology-Guided Reverse Thinking Makes Large Language Models Stronger on Knowledge Graph Question Answering	Feb 17, 2025	Graph Question AnsweringQuestion Answering	—Unverified
A Multi-answer Multi-task Framework for Real-world Machine Reading Comprehension	Oct 1, 2018	Information RetrievalMachine Reading Comprehension	—Unverified
Pangloss: Fast Entity Linking in Noisy Text Environments	Jul 16, 2018	ArticlesEntity Disambiguation	—Unverified
OODTE: A Differential Testing Engine for the ONNX Optimizer	May 3, 2025	object-detectionObject Detection	—Unverified
EVQAScore: Efficient Video Question Answering Data Evaluation	Nov 11, 2024	Keyword ExtractionQuestion Answering	—Unverified
Consistency and Uncertainty: Identifying Unreliable Responses From Black-Box Vision-Language Models for Selective Visual Question Answering	Apr 16, 2024	Language ModellingPrediction	—Unverified
ConSens: Assessing context grounding in open-book question answering	Apr 30, 2025	Question Answering	—Unverified
EWEK-QA: Enhanced Web and Efficient Knowledge Graph Retrieval for Citation-based Question Answering Systems	Jun 14, 2024	Question AnsweringRetrieval	—Unverified
HalluMix: A Task-Agnostic, Multi-Domain Benchmark for Real-World Hallucination Detection	May 1, 2025	Extractive Question-AnsweringHallucination	—Unverified
A Summary of the ALQAC 2021 Competition	Apr 22, 2022	Information RetrievalQuestion Answering	—Unverified
Open-Domain Information Access with Talking Robots	Aug 1, 2013	Dialogue ManagementQuestion Answering	—Unverified
Open-Domain Question Answering	Jul 1, 2020	Open-Domain Question AnsweringQuestion Answering	—Unverified
PALRACE: Reading Comprehension Dataset with Human Data and Labeled Rationales	Jun 23, 2021	Machine Reading ComprehensionQuestion Answering	—Unverified
A Sui Generis QA Approach using RoBERTa for Adverse Drug Event Identification	Oct 30, 2020	Domain AdaptationQuestion Answering	—Unverified
Consecutive Question Generation with Multitask Joint Reranking and Dynamic Rationale Search	Jan 16, 2022	DiversityInformativeness	—Unverified
A Multi-Agent Framework for Mitigating Dialect Biases in Privacy Policy Question-Answering Systems	Jun 3, 2025	Question Answering	—Unverified
Hallucination-minimized Data-to-answer Framework for Financial Decision-makers	Nov 9, 2023	Decision MakingHallucination	—Unverified
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models	Jul 4, 2024	HallucinationQuestion Answering	—Unverified
ConQuest: Contextual Question Paraphrasing through Answer-Aware Synthetic Question Generation	Nov 1, 2021	Natural QuestionsQuestion Answering	—Unverified
PALM: Pre-training an Autoencoding\&Autoregressive Language Model for Context-conditioned Generation	Nov 1, 2020	Abstractive Text SummarizationConversational Response Generation	—Unverified
PAM: Understanding Product Images in Cross Product Category Attribute Extraction	Jun 8, 2021	AttributeAttribute Extraction	—Unverified
Open Domain Question Answering with Conflicting Contexts	Oct 16, 2024	Open-Domain Question AnsweringQuestion Answering	—Unverified
Hallucination Detection in LLMs via Topological Divergence on Attention Graphs	Apr 14, 2025	HallucinationQuestion Answering	—Unverified
Open-Domain Why-Question Answering with Adversarial Learning to Encode Answer Texts	Jul 1, 2019	Question AnsweringSentence	—Unverified
CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement Learning	Jan 16, 2022	Conversational Question AnsweringPassage Retrieval	—Unverified
Open-ended Commonsense Reasoning with Unrestricted Answer Scope	Oct 18, 2023	Question AnsweringRetrieval	—Unverified
Open-Ended Long-Form Video Question Answering via Hierarchical Convolutional Self-Attention Networks	Jun 28, 2019	Answer GenerationDecoder	—Unverified
A Study on the Implementation Method of an Agent-Based Advanced RAG System Using Graph	Jul 29, 2024	Question AnsweringRAG	—Unverified
Expanding Frozen Vision-Language Models without Retraining: Towards Improved Robot Perception	Aug 31, 2023	Activity RecognitionHuman Activity Recognition	—Unverified
Categorization of Semantic Roles for Dictionary Definitions	Dec 1, 2016	Question Answering	—Unverified
Open-Ended Visual Question Answering by Multi-Modal Domain Adaptation	Nov 11, 2019	Domain AdaptationQuestion Answering	—Unverified
Hallucination Augmented Recitations for Language Models	Nov 13, 2023	counterfactualHallucination	—Unverified

Show:10 25 50

← PrevPage 143 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified