Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5151–5175 of 10817 papers

Title	Date	Tasks	Status
Enhancing Explainability in Multimodal Large Language Models Using Ontological Context	Sep 27, 2024	Image CaptioningQuestion Answering	—Unverified
Enhancing Event Causality Identification with Rationale and Structure-Aware Causal Question Answering	Mar 17, 2024	Event Causality IdentificationMultiple-choice	—Unverified
Building a Question Answering System for the Manufacturing Domain	Nov 19, 2021	Decision MakingQuestion Answering	—Unverified
Mitigating the Risk of Health Inequity Exacerbated by Large Language Models	Oct 7, 2024	Bias DetectionMedical Question Answering	—Unverified
Enhancing Dual-Encoders with Question and Answer Cross-Embeddings for Answer Retrieval	Jun 7, 2022	Question AnsweringRepresentation Learning	—Unverified
Building a Question and Answer System for News Domain	May 12, 2021	ArticlesQuestion Answering	—Unverified
A Grounded Memory System For Smart Personal Assistants	May 9, 2025	Entity DisambiguationImage Captioning	—Unverified
Enhancing Document Information Analysis with Multi-Task Pre-training: A Robust Approach for Information Extraction in Visually-Rich Documents	Oct 25, 2023	AllDocument Classification	—Unverified
Building and Exploring Semantic Equivalences Resources	May 1, 2012	Information RetrievalOpinion Mining	—Unverified
Enhancing Biosecurity in Tamper-Resistant Large Language Models With Quantum Gradient Descent	Jun 23, 2025	Question AnsweringSensitivity	—Unverified
Enhancing Biomedical Text Summarization and Question-Answering: On the Utility of Domain-Specific Pre-Training	Jul 10, 2023	Language ModelingLanguage Modelling	—Unverified
Building a Knowledge Graph from Natural Language Definitions for Interpretable Text Entailment Recognition	May 1, 2018	Information RetrievalOpen Information Extraction	—Unverified
Building a Human-Verified Clinical Reasoning Dataset via a Human LLM Hybrid Pipeline for Trustworthy Medical AI	May 11, 2025	Medical Question AnsweringQuestion Answering	—Unverified
A Graph Traversal Based Approach to Answer Non-Aggregation Questions Over DBpedia	Oct 16, 2015	Question Answering	—Unverified
ActionAtlas: A VideoQA Benchmark for Domain-specialized Action Recognition	Oct 8, 2024	Action RecognitionMultiple-choice	—Unverified
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation	Jun 17, 2024	Question AnsweringRAG	—Unverified
Enhancing BERT-Based Visual Question Answering through Keyword-Driven Sentence Selection	Oct 13, 2023	Language ModelingLanguage Modelling	—Unverified
Enhancing Answer Selection in Community Question Answering with Pre-trained and Large Language Models	Nov 29, 2023	Answer SelectionCommunity Question Answering	—Unverified
Enhance Long Text Understanding via Distilled Gist Detector from Abstractive Summarization	Oct 10, 2021	Abstractive Text SummarizationDocument Classification	—Unverified
Building a Dataset for Automatically Learning to Detect Questions Requiring Clarification	Jun 1, 2022	Question Answering	—Unverified
Answer Sequence Learning with Neural Networks for Answer Selection in Community Question Answering	Jun 22, 2015	Answer SelectionCommunity Question Answering	—Unverified
Enhanced Textual Feature Extraction for Visual Question Answering: A Simple Convolutional Approach	May 1, 2024	Computational EfficiencyQuestion Answering	—Unverified
Enhanced vectors for top-k document retrieval in Question Answering	Oct 8, 2022	Information RetrievalQuestion Answering	—Unverified
Building a Crisis Management Term Resource for Social Media: The Case of Floods and Protests	May 1, 2014	DescriptiveInformation Retrieval	—Unverified
Enhanced Speaker-aware Multi-party Multi-turn Dialogue Comprehension	Sep 9, 2021	Question Answering	—Unverified

Show:10 25 50

← PrevPage 207 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified