Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5851–5900 of 10817 papers

Title	Date	Tasks	Status
Diversify-verify-adapt: Efficient and Robust Retrieval-Augmented Ambiguous Question Answering	Sep 4, 2024	Question AnsweringRAG	—Unverified
Learning Transferable Representation for Bilingual Relation Extraction via Convolutional Neural Networks	Nov 1, 2017	Knowledge Base PopulationQuestion Answering	—Unverified
LLaVA-Ultra: Large Chinese Language and Vision Assistant for Ultrasound	Oct 19, 2024	Instruction FollowingKnowledge Distillation	—Unverified
Bengali Question Classification: Towards Developing QA System	Dec 1, 2012	ClassificationGeneral Classification	—Unverified
Learning Trajectory-Word Alignments for Video-Language Tasks	Jan 5, 2023	Question AnsweringRetrieval	—Unverified
Learning to Transpile AMR into SPARQL	Jan 16, 2022	Abstract Meaning RepresentationKnowledge Base Question Answering	—Unverified
Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer	Oct 15, 2023	DiversityMixture-of-Experts	—Unverified
Learning to Transpile AMR into SPARQL	Dec 15, 2021	Abstract Meaning RepresentationKnowledge Base Question Answering	—Unverified
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering	Dec 17, 2024	Graph Question AnsweringQuestion Answering	—Unverified
LLM-based Extraction of Contradictions from Patents	Mar 21, 2024	Language ModellingLarge Language Model	—Unverified
Learning to Translate for Multilingual Question Answering	Sep 26, 2016	Question AnsweringTranslation	—Unverified
LLM-Based Multi-Hop Question Answering with Knowledge Graph Integration in Evolving Environments	Aug 28, 2024	knowledge editingKnowledge Graphs	—Unverified
Diversifying Question Generation over Knowledge Base via External Natural Questions	Sep 23, 2023	DiversityNatural Questions	—Unverified
An Interactive System for Exploring Community Question Answering Forums	Dec 1, 2016	Community Question AnsweringQuestion Answering	—Unverified
A Fact Checking and Verification System for FEVEROUS Using a Zero-Shot Learning Approach	Nov 1, 2021	Fact CheckingNatural Language Inference	—Unverified
LLM Enhancer: Merged Approach using Vector Embedding for Reducing Large Language Model Hallucinations with External Knowledge	Apr 29, 2025	Language ModelingLanguage Modelling	—Unverified
Learning to Temporally Order Medical Events in Clinical Text	Jul 1, 2012	Document SummarizationInformation Retrieval	—Unverified
Learning to Summarize and Answer Questions about a Virtual Robot's Past Actions	Jun 16, 2023	Language ModelingLanguage Modelling	—Unverified
Diversifying Knowledge Enhancement of Biomedical Language Models using Adapter Modules and Knowledge Graphs	Dec 21, 2023	Document ClassificationKnowledge Graphs	—Unverified
LLMI3D: Empowering LLM with 3D Perception from a Single 2D Image	Aug 14, 2024	Autonomous DrivingLogical Reasoning	—Unverified
Learning to Summarise Related Sentences	Aug 1, 2014	Question AnsweringSentence Compression	—Unverified
LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models	Dec 31, 2024	Medical Question AnsweringMedQA	—Unverified
Learning to Specialize with Knowledge Distillation for Visual Question Answering	Dec 1, 2018	General ClassificationGeneral Knowledge	—Unverified
LLMs are not Zero-Shot Reasoners for Biomedical Information Extraction	Aug 22, 2024	named-entity-recognitionNamed Entity Recognition	—Unverified
Diversifying Joint Vision-Language Tokenization Learning	Jun 6, 2023	Question AnsweringRepresentation Learning	—Unverified
Bend but Don't Break? Multi-Challenge Stress Test for QA Models	Nov 1, 2019	Question Answering	—Unverified
Learning to Solve Geometry Problems from Natural Language Demonstrations in Textbooks	Aug 1, 2017	Question Answering	—Unverified
Learning to Select the Relevant History Turns in Conversational Question Answering	Aug 4, 2023	Binary ClassificationConversational Question Answering	—Unverified
Learning to Select Question-Relevant Relations for Visual Question Answering	Jun 1, 2021	Graph AttentionQuestion Answering	—Unverified
Diverse Multi-Answer Retrieval with Determinantal Point Processes	Nov 29, 2022	Open-Domain Question AnsweringPoint Processes	—Unverified
Benchmarks for Pirá 2.0, a Reading Comprehension Dataset about the Ocean, the Brazilian Coast, and Climate Change	Sep 19, 2023	Generative Question AnsweringInformation Retrieval	—Unverified
LLMs to Support a Domain Specific Knowledge Assistant	Feb 6, 2025	ChatbotMultiple-choice	—Unverified
An Intelligent Question Answering System based on Power Knowledge Graph	Jun 16, 2021	Question Answering	—Unverified
Learning to Selectively Transfer: Reinforced Transfer Learning for Deep Text Matching	Dec 30, 2018	Information RetrievalNatural Language Inference	—Unverified
Diverse and Non-redundant Answer Set Extraction on Community QA based on DPPs	Nov 18, 2020	Point ProcessesQuestion Answering	—Unverified
Benchmarking Vision Language Models for Cultural Understanding	Jul 15, 2024	BenchmarkingQuestion Answering	—Unverified
Ditch the Gold Standard: Re-evaluating Conversational Question Answering	Oct 16, 2021	Conversational Question AnsweringQuestion Answering	—Unverified
Learning to Rehearse in Long Sequence Memorization	Jun 2, 2021	MemorizationQuestion Answering	—Unverified
LMSim : Computing Domain-specific Semantic Word Similarities Using a Language Modeling Approach	Dec 1, 2014	Information RetrievalLanguage Modeling	—Unverified
Learning to Recover Reasoning Chains for Multi-Hop Question Answering via Cooperative Games	Apr 6, 2020	Multi-hop Question AnsweringQuestion Answering	—Unverified
Distributional Inclusion Vector Embedding for Unsupervised Hypernymy Detection	Oct 2, 2017	Hypernym DiscoveryQuestion Answering	—Unverified
An Initial Investigation of Non-Native Spoken Question-Answering	Jul 9, 2021	Question AnsweringReading Comprehension	—Unverified
Aesthetic Visual Question Answering of Photographs	Aug 10, 2022	Question AnsweringSentiment Analysis	—Unverified
Localize, Group, and Select: Boosting Text-VQA by Scene Text Modeling	Aug 20, 2021	Data AblationOptical Character Recognition	—Unverified
A Comprehensive Survey of Knowledge-Based Vision Question Answering Systems: The Lifecycle of Knowledge in Visual Reasoning Task	Apr 24, 2025	Question AnsweringRetrieval	—Unverified
Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States	Jan 7, 2025	Machine TranslationMultiple-choice	—Unverified
Learning to Recognize the Unseen Visual Predicates	Sep 25, 2019	Question AnsweringVisual Question Answering	—Unverified
Neural Reasoning, Fast and Slow, for Video Question Answering	Jul 10, 2019	Natural QuestionsQuestion Answering	—Unverified
Learning to Reason Over Time: Timeline Self-Reflection for Improved Temporal Reasoning in Language Models	Apr 7, 2025	Question AnsweringScheduling	—Unverified
Learning to Reason Iteratively and Parallelly for Complex Visual Reasoning Scenarios	Nov 20, 2024	Question AnsweringVisual Question Answering (VQA)	—Unverified

Show:10 25 50

← PrevPage 118 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified