Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 10126–10150 of 10817 papers

Title	Date	Tasks	Status
Elevating Legal LLM Responses: Harnessing Trainable Logical Structures and Semantic Knowledge with Legal Reasoning	Feb 11, 2025	HallucinationIn-Context Learning	CodeCode Available
Attentive History Selection for Conversational Question Answering	Aug 26, 2019	Conversational Question AnsweringConversational Search	CodeCode Available
El Departamento de Nosotros: How Machine Translated Corpora Affects Language Models in MRC Tasks	Jul 3, 2020	Machine TranslationQuestion Answering	CodeCode Available
CHIME: Cross-passage Hierarchical Memory Network for Generative Review Question Answering	Nov 1, 2020	Question AnsweringText Generation	CodeCode Available
Elaboration-Generating Commonsense Question Answering at Scale	Sep 2, 2022	Common Sense ReasoningQuestion Answering	CodeCode Available
EgoVLM: Policy Optimization for Egocentric Video Understanding	Jun 3, 2025	EgoSchemaQuestion Answering	CodeCode Available
ODSQA: Open-domain Spoken Question Answering Dataset	Aug 7, 2018	Data AugmentationQuestion Answering	CodeCode Available
ChatGPT as a Math Questioner? Evaluating ChatGPT on Generating Pre-university Math Questions	Dec 4, 2023	Arithmetic ReasoningMath	CodeCode Available
Enhanced Fine-Tuning of Lightweight Domain-Specific Q&A Model Based on Large Language Models	Aug 22, 2024	Question Answering	CodeCode Available
LVLM-Compress-Bench: Benchmarking the Broader Impact of Large Vision-Language Model Compression	Mar 6, 2025	BenchmarkingCommon Sense Reasoning	CodeCode Available
AmazonQA: A Review-Based Question Answering Task	Aug 12, 2019	Answer GenerationInformation Retrieval	CodeCode Available
Efficient Medical Question Answering with Knowledge-Augmented Question Generation	May 23, 2024	Language ModelingLanguage Modelling	CodeCode Available
Efficient End-to-End Video Question Answering with Pyramidal Multimodal Transformer	Feb 4, 2023	Computational EfficiencyQuestion Answering	CodeCode Available
M2QA: Multi-domain Multilingual Question Answering	Jul 1, 2024	Question Answering	CodeCode Available
Efficient Document Retrieval with G-Retriever	Apr 21, 2025	graph constructionQuestion Answering	CodeCode Available
Attention-over-Attention Neural Networks for Reading Comprehension	Jul 15, 2016	Question AnsweringReading Comprehension	CodeCode Available
OG-SGG: Ontology-Guided Scene Graph Generation. A Case Study in Transfer Learning for Telepresence Robotics	Feb 21, 2022	BIG-bench Machine LearningGraph Generation	CodeCode Available
Progressive Multi-granular Alignments for Grounded Reasoning in Large Vision-Language Models	Dec 11, 2024	Question AnsweringVisual Grounding	CodeCode Available
Macaw: An Extensible Conversational Information Seeking Platform	Dec 18, 2019	Information RetrievalQuestion Answering	CodeCode Available
Machine Comprehension by Text-to-Text Neural Question Generation	May 4, 2017	Question AnsweringQuestion Generation	CodeCode Available
Machine Comprehension Using Match-LSTM and Answer Pointer	Aug 29, 2016	Natural Language InferenceQuestion Answering	CodeCode Available
OKGIT: Open Knowledge Graph Link Prediction with Implicit Types	Jun 24, 2021	Knowledge GraphsLink Prediction	CodeCode Available
AI-TA: Towards an Intelligent Question-Answer Teaching Assistant using Open-Source LLMs	Nov 5, 2023	Question AnsweringRAG	CodeCode Available
Progressive Prompt Detailing for Improved Alignment in Text-to-Image Generative Models	Mar 22, 2025	Question AnsweringVisual Question Answering	CodeCode Available
Attention on Attention: Architectures for Visual Question Answering (VQA)	Mar 21, 2018	GPUQuestion Answering	CodeCode Available

Show:10 25 50

← PrevPage 406 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified