Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 4401–4450 of 10817 papers

Title	Date	Tasks	Status
FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity	Nov 23, 2024	AttributeCross-Modal Retrieval	—Unverified
Find the word that does not belong: A Framework for an Intrinsic Evaluation of Word Vector Representations	Aug 1, 2016	Machine TranslationOutlier Detection	—Unverified
CLAMP: Contrastive LAnguage Model Prompt-tuning	Dec 4, 2023	Contrastive LearningImage Captioning	—Unverified
ClaiRE at SemEval-2018 Task 7: Classification of Relations using Embeddings	Jun 1, 2018	ClassificationGeneral Classification	—Unverified
Aligning MAGMA by Few-Shot Learning and Finetuning	Oct 18, 2022	Few-Shot LearningImage Captioning	—Unverified
Find The Gap: Knowledge Base Reasoning For Visual Question Answering	Apr 16, 2024	Question AnsweringRetrieval	—Unverified
Finding What Matters in Questions	Jun 1, 2013	Information RetrievalQuestion Answering	—Unverified
Finding the Middle Ground - A Model for Planning Satisficing Answers	Aug 1, 2016	Question Answering	—Unverified
Finding the Evidence: Localization-aware Answer Prediction for Text Visual Question Answering	Oct 6, 2020	Optical Character RecognitionOptical Character Recognition (OCR)	—Unverified
City-VLM: Towards Multidomain Perception Scene Understanding via Multimodal Incomplete Learning	Jul 17, 2025	Question AnsweringScene Understanding	—Unverified
ARS\_NITK at MEDIQA 2019:Analysing Various Methods for Natural Language Inference, Recognising Question Entailment and Medical Question Answering System	Aug 1, 2019	Information RetrievalMedical Question Answering	—Unverified
Findings on Conversation Disentanglement	Dec 10, 2021	Conversational Question AnsweringConversation Disentanglement	—Unverified
Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora	Dec 6, 2024	Language ModelingLanguage Modelling	—Unverified
Finding Similar Medical Questions from Question Answering Websites	Oct 14, 2018	DiversityMedical Question Answering	—Unverified
Aligning LLMs through Multi-perspective User Preference Ranking-based Feedback for Programming Question Answering	May 27, 2024	Community Question AnsweringIn-Context Learning	—Unverified
Finding ReMO (Related Memory Object): A Simple Neural Architecture for Text based Reasoning	Jan 25, 2018	Question AnsweringRelation	—Unverified
Finding Optimal 1-Endpoint-Crossing Trees	Jan 1, 2013	Dependency ParsingMachine Translation	—Unverified
Citations and Trust in LLM Generated Responses	Jan 2, 2025	ChatbotQuestion Answering	—Unverified
Finding Generalizable Evidence by Learning to Convince Q\&A Models	Nov 1, 2019	Question Answering	—Unverified
Citation Analysis with Neural Attention Models	Nov 1, 2016	Information RetrievalQuestion Answering	—Unverified
Finding Answers from the Word of God: Domain Adaptation for Neural Networks in Biblical Question Answering	Oct 26, 2018	Domain AdaptationQuestion Answering	—Unverified
FinDER: Financial Dataset for Question Answering and Evaluating Retrieval-Augmented Generation	Apr 22, 2025	Question AnsweringRAG	—Unverified
CinePile: A Long Video Question Answering Dataset and Benchmark	May 14, 2024	FormHuman-Object Interaction Detection	—Unverified
Financial Knowledge Large Language Model	Jun 29, 2024	Few-Shot LearningFinancial Analysis	—Unverified
CIKQA: Learning Commonsense Inference with a Unified Knowledge-in-the-loop QA Paradigm	Oct 12, 2022	Question AnsweringTask 2	—Unverified
Around the GLOBE: Numerical Aggregation Question-Answering on Heterogeneous Genealogical Knowledge Graphs with Deep Neural Networks	Jul 30, 2023	Dataset GenerationKnowledge Graphs	—Unverified
Adapting Large Language Models to Domains via Reading Comprehension	Sep 18, 2023	Language ModelingLanguage Modelling	—Unverified
A Biomedical Question Answering System in BioASQ 2017	Aug 1, 2017	Question Answering	—Unverified
FilterRAG: Zero-Shot Informed Retrieval-Augmented Generation to Mitigate Hallucinations in VQA	Feb 25, 2025	Question AnsweringRetrieval	—Unverified
CICBUAPnlp: Graph-Based Approach for Answer Selection in Community Question Answering Task	Jun 1, 2015	Answer SelectionCommunity Question Answering	—Unverified
CIC: A Framework for Culturally-Aware Image Captioning	Feb 8, 2024	DescriptiveImage Captioning	—Unverified
A Robustly Optimized BERT Pre-training Approach with Post-training	Aug 1, 2021	Extractive Question-AnsweringQuestion Answering	—Unverified
Fill-in-the-Blank: A Challenging Video Understanding Evaluation Framework	Nov 16, 2021	Multiple-choiceQuestion Answering	—Unverified
Filling a Knowledge Graph with a Crowd	Dec 1, 2016	Knowledge GraphsQuestion Answering	—Unverified
FiE: Building a Global Probability Space by Leveraging Early Fusion in Encoder for Open-Domain Question Answering	Nov 18, 2022	Data AugmentationDecoder	—Unverified
A Road-map Towards Explainable Question Answering A Solution for Information Pollution	Jul 4, 2019	PositionQuestion Answering	—Unverified
FiDO: Fusion-in-Decoder optimized for stronger performance and faster inference	Dec 15, 2022	DecoderLanguage Modeling	—Unverified
FiD-Ex: Improving Sequence-to-Sequence Models for Extractive Rationale Generation	Dec 31, 2020	DecoderFact Verification	—Unverified
FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering	May 22, 2024	Common Sense ReasoningGraph Question Answering	—Unverified
CHOPT : Automated Hyperparameter Optimization Framework for Cloud-Based Machine Learning Platforms	Oct 8, 2018	BIG-bench Machine LearningHyperparameter Optimization	—Unverified
FFA Sora, video generation as fundus fluorescein angiography simulator	Dec 23, 2024	Privacy PreservingQuestion Answering	—Unverified
Few-Shot VQA with Frozen LLMs: A Tale of Two Approaches	Mar 17, 2024	Image CaptioningQuestion Answering	—Unverified
Few-shot Unified Question Answering: Tuning Models or Prompts?	May 23, 2023	Question AnsweringTransfer Learning	—Unverified
Chop Chop BERT: Visual Question Answering by Chopping VisualBERT's Heads	Apr 30, 2021	Question AnsweringVisual Question Answering	—Unverified
Choosing which to use? A study of distributional models for nominal lexical semantic classification	May 1, 2014	General ClassificationMachine Translation	—Unverified
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation	Apr 3, 2025	Domain GeneralizationQuestion Answering	—Unverified
Few-shot Question Generation for Personalized Feedback in Intelligent Tutoring Systems	Jun 8, 2022	Generative Question AnsweringQuestion Answering	—Unverified
Few-shot Query-Focused Summarization with Prefix-Merging	Nov 29, 2022	Few-Shot LearningQuery-focused Summarization	—Unverified
Choose Your QA Model Wisely: A Systematic Study of Generative and Extractive Readers for Question Answering	Mar 14, 2022	DecoderDomain Generalization	—Unverified
Few-shot Policy (de)composition in Conversational Question Answering	Jan 20, 2025	Conversational Question AnsweringQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 89 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified