Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 10101–10150 of 10817 papers

Title	Date	Tasks	Status
Embodied Question Answering	Nov 30, 2017	Embodied Question AnsweringNavigate	CodeCode Available
CHQ-Summ: A Dataset for Consumer Healthcare Question Summarization	Jun 14, 2022	Community Question AnsweringDescriptive	CodeCode Available
Look, Read and Enrich. Learning from Scientific Figures and their Captions	Sep 19, 2019	Multi-modal ClassificationQuestion Answering	CodeCode Available
Choice Fusion as Knowledge for Zero-Shot Dialogue State Tracking	Feb 25, 2023	DecoderDialogue State Tracking	CodeCode Available
CHIRON: Rich Character Representations in Long-Form Narratives	Jun 14, 2024	FormQuestion Answering	CodeCode Available
Re-Examining Calibration: The Case of Question Answering	May 25, 2022	Open-Domain Question AnsweringQuestion Answering	CodeCode Available
Ember: No-Code Context Enrichment via Similarity-Based Keyless Joins	Jun 2, 2021	Question AnsweringRepresentation Learning	CodeCode Available
Chinese Parsing Exploiting Characters	Aug 1, 2013	Information RetrievalMachine Translation	CodeCode Available
Loss re-scaling VQA: Revisiting the LanguagePrior Problem from a Class-imbalance View	Oct 30, 2020	Face Recognitionimage-classification	CodeCode Available
Embedding Uncertain Knowledge Graphs	Nov 26, 2018	Binary ClassificationGeneral Classification	CodeCode Available
ChiMed: A Chinese Medical Corpus for Question Answering	Aug 1, 2019	Question Answering	CodeCode Available
CHIME: Cross-passage Hierarchical Memory Network for Generative Review Question Answering	Nov 1, 2020	Question AnsweringText Generation	CodeCode Available
Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language Resamplers	Apr 21, 2024	DiagnosticImage Captioning	CodeCode Available
Lost in the Middle, and In-Between: Enhancing Language Models' Ability to Reason Over Long Contexts in Multi-Hop QA	Dec 13, 2024	Multi-hop Question AnsweringQuestion Answering	CodeCode Available
ELQA: A Corpus of Metalinguistic Questions and Answers about English	May 1, 2022	Answer GenerationQuestion Answering	CodeCode Available
Ellipsis Resolution as Question Answering: An Evaluation	Aug 29, 2019	coreference-resolutionCoreference Resolution	CodeCode Available
Eliciting Bias in Question Answering Models through Ambiguity	Nov 1, 2021	ArticlesQuestion Answering	CodeCode Available
ProCQA: A Large-scale Community-based Programming Question Answering Dataset for Code Search	Mar 25, 2024	Code SearchQuestion Answering	CodeCode Available
Object Attribute Matters in Visual Question Answering	Dec 20, 2023	AttributeGraph Neural Network	CodeCode Available
Object-aware Adaptive-Positivity Learning for Audio-Visual Question Answering	Dec 20, 2023	Audio-visual Question AnsweringAudio-Visual Question Answering (AVQA)	CodeCode Available
ANTIQUE: A Non-Factoid Question Answering Benchmark	May 22, 2019	Community Question AnsweringInformation Retrieval	CodeCode Available
Product-Aware Answer Generation in E-Commerce Question-Answering	Jan 23, 2019	Answer GenerationQuestion Answering	CodeCode Available
Answer Them All! Toward Universal Visual Question Answering Models	Mar 1, 2019	AllQuestion Answering	CodeCode Available
LPF: A Language-Prior Feedback Objective Function for De-biased Visual Question Answering	May 29, 2021	Question AnsweringVisual Question Answering	CodeCode Available
LP-LM: No Hallucinations in Question Answering with Logic Programming	Feb 13, 2025	Question AnsweringSemantic Parsing	CodeCode Available
Answers Unite! Unsupervised Metrics for Reinforced Summarization Models	Sep 4, 2019	Abstractive Text SummarizationQuestion Answering	CodeCode Available
Elevating Legal LLM Responses: Harnessing Trainable Logical Structures and Semantic Knowledge with Legal Reasoning	Feb 11, 2025	HallucinationIn-Context Learning	CodeCode Available
El Departamento de Nosotros: How Machine Translated Corpora Affects Language Models in MRC Tasks	Jul 3, 2020	Machine TranslationQuestion Answering	CodeCode Available
RAMQA: A Unified Framework for Retrieval-Augmented Multi-Modal Question Answering	Jan 23, 2025	DecoderInformation Retrieval	CodeCode Available
Elaboration-Generating Commonsense Question Answering at Scale	Sep 2, 2022	Common Sense ReasoningQuestion Answering	CodeCode Available
RA-MTR: A Retrieval Augmented Multi-Task Reader based Approach for Inspirational Quote Extraction from Long Documents	Feb 17, 2025	ArticlesOpen-Domain Question Answering	CodeCode Available
EgoVLM: Policy Optimization for Egocentric Video Understanding	Jun 3, 2025	EgoSchemaQuestion Answering	CodeCode Available
Enhanced Fine-Tuning of Lightweight Domain-Specific Q&A Model Based on Large Language Models	Aug 22, 2024	Question Answering	CodeCode Available
ChatGPT as a Math Questioner? Evaluating ChatGPT on Generating Pre-university Math Questions	Dec 4, 2023	Arithmetic ReasoningMath	CodeCode Available
ODSQA: Open-domain Spoken Question Answering Dataset	Aug 7, 2018	Data AugmentationQuestion Answering	CodeCode Available
Efficient Medical Question Answering with Knowledge-Augmented Question Generation	May 23, 2024	Language ModelingLanguage Modelling	CodeCode Available
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression	Mar 6, 2025	BenchmarkingCommon Sense Reasoning	CodeCode Available
AI-TA: Towards an Intelligent Question-Answer Teaching Assistant using Open-Source LLMs	Nov 5, 2023	Question AnsweringRAG	CodeCode Available
Efficient End-to-End Video Question Answering with Pyramidal Multimodal Transformer	Feb 4, 2023	Computational EfficiencyQuestion Answering	CodeCode Available
Efficient Document Retrieval with G-Retriever	Apr 21, 2025	graph constructionQuestion Answering	CodeCode Available
M2QA: Multi-domain Multilingual Question Answering	Jul 1, 2024	Question Answering	CodeCode Available
Efficient Document Re-Ranking for Transformers by Precomputing Term Representations	Apr 29, 2020	Document RankingQuestion Answering	CodeCode Available
Attention-over-Attention Neural Networks for Reading Comprehension	Jul 15, 2016	Question AnsweringReading Comprehension	CodeCode Available
Revisiting CroPA: A Reproducibility Study and Enhancements for Cross-Prompt Adversarial Transferability in Vision-Language Models	Jun 28, 2025	image-classificationImage Classification	CodeCode Available
OG-SGG: Ontology-Guided Scene Graph Generation. A Case Study in Transfer Learning for Telepresence Robotics	Feb 21, 2022	BIG-bench Machine LearningGraph Generation	CodeCode Available
Macaw: An Extensible Conversational Information Seeking Platform	Dec 18, 2019	Information RetrievalQuestion Answering	CodeCode Available
Machine Comprehension by Text-to-Text Neural Question Generation	May 4, 2017	Question AnsweringQuestion Generation	CodeCode Available
Machine Comprehension Using Match-LSTM and Answer Pointer	Aug 29, 2016	Natural Language InferenceQuestion Answering	CodeCode Available
Attention on Attention: Architectures for Visual Question Answering (VQA)	Mar 21, 2018	GPUQuestion Answering	CodeCode Available
OKGIT: Open Knowledge Graph Link Prediction with Implicit Types	Jun 24, 2021	Knowledge GraphsLink Prediction	CodeCode Available

Show:10 25 50

← PrevPage 203 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified