Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5151–5200 of 10817 papers

Title	Date	Tasks	Status
Enhancing Explainability in Multimodal Large Language Models Using Ontological Context	Sep 27, 2024	Image CaptioningQuestion Answering	—Unverified
Enhancing Event Causality Identification with Rationale and Structure-Aware Causal Question Answering	Mar 17, 2024	Event Causality IdentificationMultiple-choice	—Unverified
Building a Question Answering System for the Manufacturing Domain	Nov 19, 2021	Decision MakingQuestion Answering	—Unverified
Mitigating the Risk of Health Inequity Exacerbated by Large Language Models	Oct 7, 2024	Bias DetectionMedical Question Answering	—Unverified
Enhancing Dual-Encoders with Question and Answer Cross-Embeddings for Answer Retrieval	Jun 7, 2022	Question AnsweringRepresentation Learning	—Unverified
Building a Question and Answer System for News Domain	May 12, 2021	ArticlesQuestion Answering	—Unverified
A Grounded Memory System For Smart Personal Assistants	May 9, 2025	Entity DisambiguationImage Captioning	—Unverified
Enhancing Document Information Analysis with Multi-Task Pre-training: A Robust Approach for Information Extraction in Visually-Rich Documents	Oct 25, 2023	AllDocument Classification	—Unverified
Building and Exploring Semantic Equivalences Resources	May 1, 2012	Information RetrievalOpinion Mining	—Unverified
Enhancing Biosecurity in Tamper-Resistant Large Language Models With Quantum Gradient Descent	Jun 23, 2025	Question AnsweringSensitivity	—Unverified
Enhancing Biomedical Text Summarization and Question-Answering: On the Utility of Domain-Specific Pre-Training	Jul 10, 2023	Language ModelingLanguage Modelling	—Unverified
Building a Knowledge Graph from Natural Language Definitions for Interpretable Text Entailment Recognition	May 1, 2018	Information RetrievalOpen Information Extraction	—Unverified
Building a Human-Verified Clinical Reasoning Dataset via a Human LLM Hybrid Pipeline for Trustworthy Medical AI	May 11, 2025	Medical Question AnsweringQuestion Answering	—Unverified
A Graph Traversal Based Approach to Answer Non-Aggregation Questions Over DBpedia	Oct 16, 2015	Question Answering	—Unverified
ActionAtlas: A VideoQA Benchmark for Domain-specialized Action Recognition	Oct 8, 2024	Action RecognitionMultiple-choice	—Unverified
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation	Jun 17, 2024	Question AnsweringRAG	—Unverified
Enhancing BERT-Based Visual Question Answering through Keyword-Driven Sentence Selection	Oct 13, 2023	Language ModelingLanguage Modelling	—Unverified
Enhancing Answer Selection in Community Question Answering with Pre-trained and Large Language Models	Nov 29, 2023	Answer SelectionCommunity Question Answering	—Unverified
Enhance Long Text Understanding via Distilled Gist Detector from Abstractive Summarization	Oct 10, 2021	Abstractive Text SummarizationDocument Classification	—Unverified
Building a Dataset for Automatically Learning to Detect Questions Requiring Clarification	Jun 1, 2022	Question Answering	—Unverified
Answer Sequence Learning with Neural Networks for Answer Selection in Community Question Answering	Jun 22, 2015	Answer SelectionCommunity Question Answering	—Unverified
Enhanced Textual Feature Extraction for Visual Question Answering: A Simple Convolutional Approach	May 1, 2024	Computational EfficiencyQuestion Answering	—Unverified
Enhanced vectors for top-k document retrieval in Question Answering	Oct 8, 2022	Information RetrievalQuestion Answering	—Unverified
Building a Crisis Management Term Resource for Social Media: The Case of Floods and Protests	May 1, 2014	DescriptiveInformation Retrieval	—Unverified
Enhanced Speaker-aware Multi-party Multi-turn Dialogue Comprehension	Sep 9, 2021	Question Answering	—Unverified
Enhanced Question-Answering for Skill-based learning using Knowledge-based AI and Generative AI	Apr 10, 2025	Question Answering	—Unverified
Building a Corpus for Japanese Wikification with Fine-Grained Entity Classes	Aug 1, 2016	Coreference ResolutionEntity Linking	—Unverified
Answer Sentence Retrieval by Matching Dependency Paths acquired from Question/Answer Sentence Pairs	Apr 1, 2012	Information RetrievalQuestion Answering	—Unverified
A Graph-Retrieval-Augmented Generation Framework Enhances Decision-Making in the Circular Economy	Jun 1, 2025	Decision MakingMulti-hop Question Answering	—Unverified
Enhanced Multimodal RAG-LLM for Accurate Visual Question Answering	Dec 30, 2024	Image CaptioningObject Recognition	—Unverified
Enhanced Knowledge Graphs Using Typed Entailment Graphs	Jan 20, 2022	Knowledge GraphsOpen Information Extraction	—Unverified
Enhanced Electronic Health Records Text Summarization Using Large Language Models	Oct 12, 2024	Question AnsweringReading Comprehension	—Unverified
Build-a-Bot: Teaching Conversational AI Using a Transformer-Based Intent Recognition and Question Answering Architecture	Dec 14, 2022	AI AgentChatbot	—Unverified
Enhanced Chart Understanding in Vision and Language Task via Cross-modal Pre-training on Plot Table Pairs	May 29, 2023	Chart Question AnsweringChart Understanding	—Unverified
Enhanced Aspect Level Sentiment Classification with Auxiliary Memory	Aug 1, 2018	ClassificationFeature Engineering	—Unverified
English-Korean Named Entity Transliteration Using Substring Alignment and Re-ranking Methods	Jul 1, 2012	Information RetrievalMachine Translation	—Unverified
English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too	Jun 3, 2020	Cross-Lingual TransferQuestion Answering	—Unverified
BuDDIE: A Business Document Dataset for Multi-task Information Extraction	Apr 5, 2024	Document Classificationdocument understanding	—Unverified
Answer Selection in Arabic Community Question Answering: A Feature-Rich Approach	Jul 1, 2015	Answer SelectionCommunity Question Answering	—Unverified
A Graph Representation of Semi-structured Data for Web Question Answering	Oct 14, 2020	Question Answering	—Unverified
English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too	May 26, 2020	Cross-Lingual TransferHellaSwag	—Unverified
BR-TaxQA-R: A Dataset for Question Answering with References for Brazilian Personal Income Tax Law, including case law	May 21, 2025	Answer GenerationQuestion Answering	—Unverified
Enforcing Reasoning in Visual Commonsense Reasoning	Oct 21, 2019	Question AnsweringReinforcement Learning	—Unverified
Energy-Efficient Inference Accelerator for Memory-Augmented Neural Networks on an FPGA	May 21, 2018	GPUQuestion Answering	—Unverified
BRIT: Bidirectional Retrieval over Unified Image-Text Graph	May 24, 2025	Image to textQuestion Answering	—Unverified
Answer ranking in Community Question Answering: a deep learning approach	Oct 16, 2022	AttributeCommunity Question Answering	—Unverified
End-to-End Vision Tokenizer Tuning	May 15, 2025	Image GenerationQuestion Answering	—Unverified
End-to-End Video Question Answering with Frame Scoring Mechanisms and Adaptive Sampling	Jul 21, 2024	Question AnsweringVideo Question Answering	—Unverified
Bring Remote Sensing Object Detect Into Nature Language Model: Using SFT Method	Mar 11, 2025	Language ModelingLanguage Modelling	—Unverified
Answer Ranking for Product-Related Questions via Multiple Semantic Relations Modeling	Jun 28, 2020	Natural Language InferenceQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 104 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified