Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 4401–4450 of 10817 papers

Title	Date	Tasks	Status
1-800-SHARED-TASKS at RegNLP: Lexical Reranking of Semantic Retrieval (LeSeR) for Regulatory Question Answering	Dec 8, 2024	Answer GenerationDomain Adaptation	—Unverified
Improving Skin Condition Classification with a Visual Symptom Checker Trained using Reinforcement Learning	Mar 8, 2019	General ClassificationQuestion Answering	—Unverified
Designing Templates for Eliciting Commonsense Knowledge from Pretrained Sequence-to-Sequence Models	Dec 1, 2020	Multiple-choiceNatural Language Understanding	—Unverified
BACON: Improving Clarity of Image Captions via Bag-of-Concept Graphs	Jul 3, 2024	Image CaptioningImage Generation	—Unverified
Designing dialogue systems: A mean, grumpy, sarcastic chatbot in the browser	Sep 20, 2019	ChatbotDecoder	—Unverified
Designing a Robust Radiology Report Generation System	Nov 2, 2024	Decision MakingDiagnostic	—Unverified
Backward and Forward Language Modeling for Constrained Sentence Generation	Dec 21, 2015	Language ModelingLanguage Modelling	—Unverified
A Neural Approach to KGQA via SPARQL Silhouette Generation	Nov 16, 2021	Graph Question AnsweringMachine Translation	—Unverified
Designing a Communication Bridge between Communities: Participatory Design for a Question-Answering AI Agent	Aug 1, 2023	AI AgentQuestion Answering	—Unverified
Back to Basics for Monolingual Alignment: Exploiting Word Similarity and Contextual Evidence	Jan 1, 2014	Natural Language InferenceQuestion Answering	—Unverified
Design and Development of Rule-based open-domain Question-Answering System on SQuAD v2.0 Dataset	Mar 27, 2022	Open-Domain Question AnsweringQuestion Answering	—Unverified
Backpropagation-Free Multi-modal On-Device Model Adaptation via Cloud-Device Collaboration	May 21, 2024	Question AnsweringVideo Question Answering	—Unverified
Adversarial and Safely Scaled Question Generation	Oct 17, 2022	MisinformationQuestion Answering	—Unverified
Improving Skin Condition Classification with a Question Answering Model	Nov 15, 2018	ClassificationGeneral Classification	—Unverified
Improving Span-based Question Answering Systems with Coarsely Labeled Data	Nov 5, 2018	Multi-Task LearningQuestion Answering	—Unverified
Improving Twitter Named Entity Recognition using Word Representations	Jul 1, 2015	named-entity-recognitionNamed Entity Recognition	—Unverified
IM-RAG: Multi-Round Retrieval-Augmented Generation Through Learning Inner Monologues	May 15, 2024	Information RetrievalQuestion Answering	—Unverified
Incremental Knowledge Based Question Answering	Jan 18, 2021	Incremental LearningKnowledge Distillation	—Unverified
Desiderata for the Context Use of Question Answering Systems	Jan 31, 2024	Question Answering	—Unverified
Description Logics based Formalization of Wh-Queries	Dec 25, 2013	Information RetrievalQuestion Answering	—Unverified
An Entity-Based approach to Answering Recurrent and Non-Recurrent Questions with Past Answers	Dec 1, 2016	Community Question AnsweringEntity Linking	—Unverified
Description Based Text Classification with Reinforcement Learning	Feb 8, 2020	ClassificationGeneral Classification	—Unverified
Adventurer's Treasure Hunt: A Transparent System for Visually Grounded Compositional Visual Question Answering based on Scene Graphs	Jun 28, 2021	Question AnsweringTask 2	—Unverified
An Entailment Tree Generation Approach for Multimodal Multi-Hop Question Answering with Mixture-of-Experts and Iterative Feedback Mechanism	Dec 8, 2024	Mixture-of-ExpertsMulti-hop Question Answering	—Unverified
Backdooring Vision-Language Models with Out-Of-Distribution Data	Oct 2, 2024	Image CaptioningImage to text	—Unverified
Improving Question Classification by Feature Extraction and Selection	Jan 1, 2016	Classificationfeature selection	—Unverified
DERI\&UPM: Pushing Corpus Based Relatedness to Similarity: Shared Task System Description	Jul 1, 2012	Document SummarizationMachine Translation	—Unverified
DERA: Enhancing Large Language Model Completions with Dialog-Enabled Resolving Agents	Mar 30, 2023	Conversation SummarizationLanguage Modeling	—Unverified
Improving Reliability and Explainability of Medical Question Answering through Atomic Fact Checking in Retrieval-Augmented LLMs	May 30, 2025	Fact CheckingHallucination	—Unverified
Dependent Gated Reading for Cloze-Style Question Answering	May 26, 2018	Decision MakingQuestion Answering	—Unverified
Dependency Parsing: Past, Present, and Future	Aug 1, 2014	Dependency ParsingDomain Adaptation	—Unverified
Dependency Parsing for Weibo: An Efficient Probabilistic Logic Programming Approach	Oct 1, 2014	Dependency ParsingMachine Translation	—Unverified
Dependency Extraction for Knowledge-based Domain Classification	Dec 1, 2015	Classificationdomain classification	—Unverified
An Ensemble Approach to Question Classification: Integrating Electra Transformer, GloVe, and LSTM	Aug 13, 2023	ClassificationMachine Translation	—Unverified
A Compare-Aggregate Model with Latent Clustering for Answer Selection	May 30, 2019	Answer SelectionClustering	—Unverified
Dependency-Based Open Information Extraction	Apr 1, 2012	Dependency ParsingNatural Language Inference	—Unverified
A Zero-Shot Claim Detection Framework Using Question Answering	Oct 1, 2022	MisinformationObject	—Unverified
An English-Portuguese parallel corpus of questions: translation guidelines and application in SMT	May 1, 2012	Machine TranslationQuestion Answering	—Unverified
PolQA: Polish Question Answering Dataset	Dec 17, 2022	Open-Domain Question AnsweringPassage Retrieval	—Unverified
Improving Question Answering with Generation of NQ-like Questions	Oct 12, 2022	Natural QuestionsQuestion Answering	—Unverified
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks	Jul 22, 2023	named-entity-recognitionNamed Entity Recognition	—Unverified
Dense but Efficient VideoQA for Intricate Compositional Reasoning	Oct 19, 2022	Question AnsweringVideo Question Answering	—Unverified
Axiomatic Preference Modeling for Longform Question Answering	Dec 2, 2023	Question Answering	—Unverified
An End-to-End Model for Question Answering over Knowledge Base with Cross-Attention Combining Global Knowledge	Jul 1, 2017	Information RetrievalQuestion Answering	—Unverified
A Comparative Study of Transformer-Based Language Models on Extractive Question Answering	Oct 7, 2021	Extractive Question-AnsweringQuestion Answering	—Unverified
AWS CORD-19 Search: A Neural Search Engine for COVID-19 Literature	Jul 17, 2020	ArticlesDocument Ranking	—Unverified
Improving Query Graph Generation for Complex Question Answering over Knowledge Base	Nov 1, 2021	Graph GenerationQuestion Answering	—Unverified
An End-to-End Framework for Cold Question Routing in Community Question Answering Services	Nov 22, 2019	Community Question AnsweringGraph Embedding	—Unverified
Denoise while Aggregating: Collaborative Learning in Open-Domain Question Answering	Sep 27, 2018	Open-Domain Question AnsweringQuestion Answering	—Unverified
AdvCodec: Towards A Unified Framework for Adversarial Text Generation	Sep 25, 2019	Adversarial TextQuestion Answering	—Unverified

Show:10 25 50

← PrevPage 89 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified