Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 3276–3300 of 10817 papers

Title	Date	Tasks	Status
Enforcing Reasoning in Visual Commonsense Reasoning	Oct 21, 2019	Question AnsweringReinforcement Learning	—Unverified
Dual Capsule Attention Mask Network with Mutual Learning for Visual Question Answering	Oct 1, 2022	Question AnsweringVisual Question Answering	—Unverified
English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too	May 26, 2020	Cross-Lingual TransferHellaSwag	—Unverified
English Intermediate-Task Training Improves Zero-Shot Cross-Lingual Transfer Too	Jun 3, 2020	Cross-Lingual TransferQuestion Answering	—Unverified
English-Korean Named Entity Transliteration Using Substring Alignment and Re-ranking Methods	Jul 1, 2012	Information RetrievalMachine Translation	—Unverified
Enhanced Aspect Level Sentiment Classification with Auxiliary Memory	Aug 1, 2018	ClassificationFeature Engineering	—Unverified
Enhanced Chart Understanding in Vision and Language Task via Cross-modal Pre-training on Plot Table Pairs	May 29, 2023	Chart Question AnsweringChart Understanding	—Unverified
Enhanced Electronic Health Records Text Summarization Using Large Language Models	Oct 12, 2024	Question AnsweringReading Comprehension	—Unverified
Enhanced Knowledge Graphs Using Typed Entailment Graphs	Jan 20, 2022	Knowledge GraphsOpen Information Extraction	—Unverified
Big Help or Big Brother? Auditing Tracking, Profiling, and Personalization in Generative AI Assistants	Mar 20, 2025	Question Answering	—Unverified
Enhanced Multimodal RAG-LLM for Accurate Visual Question Answering	Dec 30, 2024	Image CaptioningObject Recognition	—Unverified
Enhanced Question-Answering for Skill-based learning using Knowledge-based AI and Generative AI	Apr 10, 2025	Question Answering	—Unverified
Enhanced Speaker-aware Multi-party Multi-turn Dialogue Comprehension	Sep 9, 2021	Question Answering	—Unverified
Enhanced vectors for top-k document retrieval in Question Answering	Oct 8, 2022	Information RetrievalQuestion Answering	—Unverified
Enhanced Textual Feature Extraction for Visual Question Answering: A Simple Convolutional Approach	May 1, 2024	Computational EfficiencyQuestion Answering	—Unverified
Enhance Long Text Understanding via Distilled Gist Detector from Abstractive Summarization	Oct 10, 2021	Abstractive Text SummarizationDocument Classification	—Unverified
Enhancing Answer Selection in Community Question Answering with Pre-trained and Large Language Models	Nov 29, 2023	Answer SelectionCommunity Question Answering	—Unverified
Enhancing BERT-Based Visual Question Answering through Keyword-Driven Sentence Selection	Oct 13, 2023	Language ModelingLanguage Modelling	—Unverified
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation	Jun 17, 2024	Question AnsweringRAG	—Unverified
Modeling Uncertainty and Using Post-fusion as Fallback Improves Retrieval Augmented Generation with LLMs	Aug 24, 2023	Answer GenerationOpen-Domain Question Answering	—Unverified
Enhancing Biosecurity in Tamper-Resistant Large Language Models With Quantum Gradient Descent	Jun 23, 2025	Question AnsweringSensitivity	—Unverified
A Novel Approach Towards Incorporating Context Processing Capabilities in NLIDB System	Oct 1, 2013	Question Answering	—Unverified
Building a Knowledge Graph from Natural Language Definitions for Interpretable Text Entailment Recognition	May 1, 2018	Information RetrievalOpen Information Extraction	—Unverified
Exploring the In-context Learning Ability of Large Language Model for Biomedical Concept Linking	Jul 3, 2023	In-Context LearningInformation Retrieval	—Unverified
Exploring The Landscape of Distributional Robustness for Question Answering Models	Oct 22, 2022	In-Context LearningQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 132 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified