Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2401–2425 of 10817 papers

Title	Date	Tasks	Status
Citation Analysis with Neural Attention Models	Nov 1, 2016	Information RetrievalQuestion Answering	—Unverified
Around the GLOBE: Numerical Aggregation Question-Answering on Heterogeneous Genealogical Knowledge Graphs with Deep Neural Networks	Jul 30, 2023	Dataset GenerationKnowledge Graphs	—Unverified
CinePile: A Long Video Question Answering Dataset and Benchmark	May 14, 2024	FormHuman-Object Interaction Detection	—Unverified
CIKQA: Learning Commonsense Inference with a Unified Knowledge-in-the-loop QA Paradigm	Oct 12, 2022	Question AnsweringTask 2	—Unverified
Adapting Large Language Models to Domains via Reading Comprehension	Sep 18, 2023	Language ModelingLanguage Modelling	—Unverified
A Biomedical Knowledge Graph for Biomarker Discovery in Cancer	Feb 9, 2023	ArticlesData Integration	—Unverified
Document Attribution: Examining Citation Relationships using Large Language Models	May 9, 2025	Document SummarizationNatural Language Inference	—Unverified
CICBUAPnlp: Graph-Based Approach for Answer Selection in Community Question Answering Task	Jun 1, 2015	Answer SelectionCommunity Question Answering	—Unverified
CIC: A Framework for Culturally-Aware Image Captioning	Feb 8, 2024	DescriptiveImage Captioning	—Unverified
A Robustly Optimized BERT Pre-training Approach with Post-training	Aug 1, 2021	Extractive Question-AnsweringQuestion Answering	—Unverified
A Road-map Towards Explainable Question Answering A Solution for Information Pollution	Jul 4, 2019	PositionQuestion Answering	—Unverified
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation	Apr 3, 2025	Domain GeneralizationQuestion Answering	—Unverified
DOCENT: Learning Self-Supervised Entity Representations from Large Document Collections	Feb 26, 2021	Knowledge Base CompletionNatural Language Queries	—Unverified
CHOPT : Automated Hyperparameter Optimization Framework for Cloud-Based Machine Learning Platforms	Oct 8, 2018	BIG-bench Machine LearningHyperparameter Optimization	—Unverified
Adapting Large Language Models for Education: Foundational Capabilities, Potentials, and Challenges	Dec 27, 2023	Question Answering	—Unverified
Chop Chop BERT: Visual Question Answering by Chopping VisualBERT's Heads	Apr 30, 2021	Question AnsweringVisual Question Answering	—Unverified
Choosing which to use? A study of distributional models for nominal lexical semantic classification	May 1, 2014	General ClassificationMachine Translation	—Unverified
SAGE: A Framework of Precise Retrieval for RAG	Mar 3, 2025	Question AnsweringRAG	—Unverified
Docforia: A Multilayer Document Model	May 1, 2017	Coreference ResolutionDependency Parsing	—Unverified
Choose Your QA Model Wisely: A Systematic Study of Generative and Extractive Readers for Question Answering	Mar 14, 2022	DecoderDomain Generalization	—Unverified
Aligning a medium-size GPT model in English to a small closed domain in Spanish	Mar 30, 2023	Question Answering	—Unverified
ChitroJera: A Regionally Relevant Visual Question Answering Dataset for Bangla	Oct 19, 2024	Question AnsweringVisual Question Answering	—Unverified
Argument structure of adverbial derivatives in Russian	Aug 1, 2014	Machine TranslationNatural Language Inference	—Unverified
DLS@CU: Sentence Similarity from Word Alignment	Aug 1, 2014	Information RetrievalMachine Translation	—Unverified
Argument Similarity Assessment in German for Intelligent Tutoring: Crowdsourced Dataset and First Experiments	Jun 1, 2022	Question Answeringtext-classification	—Unverified

Show:10 25 50

← PrevPage 97 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified