Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5001–5050 of 10817 papers

Title	Date	Tasks	Status
Explaining ELH Concept Descriptions through Counterfactual Reasoning	Jan 12, 2023	counterfactualCounterfactual Reasoning	—Unverified
Improving Natural Language Inference Using External Knowledge in the Science Questions Domain	Sep 15, 2018	Knowledge GraphsNatural Language Inference	—Unverified
Invar-RAG: Invariant LLM-aligned Retrieval for Better Generation	Nov 11, 2024	HallucinationInformation Retrieval	—Unverified
Inverse Visual Question Answering: A New Benchmark and VQA Diagnosis Tool	Mar 16, 2018	Question AnsweringReinforcement Learning	—Unverified
KnowledgeNavigator: Leveraging Large Language Models for Enhanced Reasoning over Knowledge Graph	Dec 26, 2023	HallucinationLanguage Modeling	—Unverified
Investigating and Addressing Hallucinations of LLMs in Tasks Involving Negation	Jun 8, 2024	Abstractive Text SummarizationDialogue Generation	—Unverified
A Diachronic Corpus for Romanian (RoDia)	Sep 1, 2017	Information RetrievalOptical Character Recognition (OCR)	—Unverified
Investigating Biases in Textual Entailment Datasets	Jun 23, 2019	BIG-bench Machine LearningNatural Language Inference	—Unverified
Investigating Data Contamination in Modern Benchmarks for Large Language Models	Nov 16, 2023	Common Sense ReasoningMMLU	—Unverified
Investigating Energy Efficiency and Performance Trade-offs in LLM Inference Across Tasks and DVFS Settings	Jan 14, 2025	BenchmarkingQuestion Answering	—Unverified
Knowledge Portability with Semantic Expansion of Ontology Labels	Jul 1, 2015	Information RetrievalMachine Translation	—Unverified
Investigating Information Inconsistency in Multilingual Open-Domain Question Answering	May 25, 2022	Open-Domain Question AnsweringQuestion Answering	—Unverified
Knowledge Proxy Intervention for Deconfounded Video Question Answering	Jan 1, 2023	Question AnsweringVideo Question Answering	—Unverified
Investigating Mysteries of CoT-Augmented Distillation	Jun 20, 2024	Question Answering	—Unverified
Improving mitosis detection on histopathology images using large vision-language models	Oct 11, 2023	Domain GeneralizationImage Captioning	—Unverified
Attention-guided Generative Models for Extractive Question Answering	Oct 12, 2021	DecoderExtractive Question-Answering	—Unverified
Attention Guided Semantic Relationship Parsing for Visual Question Answering	Oct 5, 2020	ObjectQuestion Answering	—Unverified
Investigating the Generative Approach for Question Answering in E-Commerce	May 1, 2022	Answer GenerationQuestion Answering	—Unverified
CUB: Benchmarking Context Utilisation Techniques for Language Models	May 22, 2025	BenchmarkingFact Checking	—Unverified
Investigating the use of Paraphrase Generation for Question Reformulation in the FRANK QA system	Jun 6, 2022	Paraphrase GenerationQuestion Answering	—Unverified
LEANN: A Low-Storage Vector Index	Jun 9, 2025	Question AnsweringRAG	—Unverified
Invited Talk: IBM Cognitive Computing - An NLP Renaissance!	Oct 1, 2014	Machine TranslationQuestion Answering	—Unverified
Improving Long Text Understanding with Knowledge Distilled from Summarization Model	May 8, 2024	Abstractive Text SummarizationDocument Classification	—Unverified
CoT Rerailer: Enhancing the Reliability of Large Language Models in Complex Reasoning Tasks through Error Detection and Correction	Aug 25, 2024	Decision MakingQuestion Answering	—Unverified
Improving LLM First-Token Predictions in Multiple-Choice Question Answering via Prefilling Attack	May 21, 2025	Multiple-choiceMultiple Choice Question Answering (MCQA)	—Unverified
iPerceive: Applying Common-Sense Reasoning to Multi-Modal Dense Video Captioning and Video Question Answering	Nov 16, 2020	Common Sense ReasoningDense Video Captioning	—Unverified
IPFormer-VideoLLM: Enhancing Multi-modal Video Understanding for Multi-shot Scenes	Jun 26, 2025	AttributeQuestion Answering	—Unverified
IQA-EVAL: Automatic Evaluation of Human-Model Interactive Question Answering	Aug 24, 2024	Question AnsweringTask 2	—Unverified
CUNI Submission to MRL 2023 Shared Task on Multi-lingual Multi-task Information Retrieval	Oct 25, 2023	Information RetrievalMachine Translation	—Unverified
iQUEST: An Iterative Question-Guided Framework for Knowledge Base Question Answering	Jun 2, 2025	Graph Neural NetworkKnowledge Base Question Answering	—Unverified
Knowledge Informed Semantic Parsing for Conversational Question Answering	Aug 1, 2021	Conversational Question AnsweringDecoder	—Unverified
IQViC: In-context, Question Adaptive Vision Compressor for Long-term Video Understanding LMMs	Dec 13, 2024	Question AnsweringVideo Question Answering	—Unverified
iReason: Multimodal Commonsense Reasoning using Videos and Natural Language with Interpretability	Jun 25, 2021	Bias DetectionQuestion Answering	—Unverified
Curio SmartChat : A system for Natural Language Question Answering for Self-Paced K-12 Learning	Aug 1, 2019	Question Answering	—Unverified
Knowledge Models for Cancer Clinical Practice Guidelines : Construction, Management and Usage in Question Answering	Jul 23, 2024	ManagementQuestion Answering	—Unverified
IRIS: a Chat-oriented Dialogue System based on the Vector Space Model	Jul 1, 2012	Question AnsweringSpeech Recognition	—Unverified
IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models	Jun 5, 2024	Mathematical ReasoningNatural Language Inference	—Unverified
ISAAQ -- Mastering Textbook Questions with Pre-trained Transformers and Bottom-Up and Top-Down Attention	Oct 1, 2020	Multiple-choiceQuestion Answering	—Unverified
Knowledge Pyramid: A Novel Hierarchical Reasoning Structure for Generalized Knowledge Augmentation and Inference	Jan 17, 2024	Decision MakingInformation Retrieval	—Unverified
Improving Lexical Embeddings for Robust Question Answering	Feb 28, 2022	Question Answering	—Unverified
Is a Video worth n n Images? A Highly Efficient Approach to Transformer-based Video Question Answering	May 16, 2023	Question AnsweringVideo Question Answering	—Unverified
Curriculum Learning for Compositional Visual Reasoning	Mar 27, 2023	Question AnsweringVisual Question Answering	—Unverified
Improving Legal Information Retrieval by Distributional Composition with Term Order Probabilities	Jun 4, 2017	Information RetrievalQuestion Answering	—Unverified
IS-GGT: Iterative Scene Graph Generation With Generative Transformers	Jan 1, 2023	Graph GenerationLink Prediction	—Unverified
Is GPT-3 all you need for Visual Question Answering in Cultural Heritage?	Jul 25, 2022	AllQuestion Answering	—Unverified
Is Graph Structure Necessary for Multi-hop Question Answering?	Apr 7, 2020	Graph AttentionMulti-hop Question Answering	—Unverified
Is It Dish Washer Safe? Automatically Answering ``Yes/No'' Questions Using Customer Reviews	Jun 1, 2019	Question AnsweringReading Comprehension	—Unverified
IslamicPCQA: A Dataset for Persian Multi-hop Complex Question Answering in Islamic Text Resources	Apr 23, 2023	Question Answering	—Unverified
Automated Graph Generation at Sentence Level for Reading Comprehension Based on Conceptual Graphs	Dec 1, 2020	Graph GenerationMiscellaneous	—Unverified
CoTAR: Chain-of-Thought Attribution Reasoning with Multi-level Granularity	Apr 16, 2024	Question Answering	—Unverified

Show:10 25 50

← PrevPage 101 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified