Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 4151–4200 of 10817 papers

Title	Date	Tasks	Status
How much should you ask? On the question structure in QA systems.	Nov 1, 2018	Question Answeringvalid	—Unverified
How much should you ask? On the question structure in QA systems	Sep 11, 2018	Question Answeringvalid	—Unverified
DLS@CU: Sentence Similarity from Word Alignment	Aug 1, 2014	Information RetrievalMachine Translation	—Unverified
DLS@CU: Sentence Similarity from Word Alignment and Semantic Vector Composition	Jun 1, 2015	Information RetrievalMachine Translation	—Unverified
An Introductory Survey on Attention Mechanisms in NLP Problems	Nov 12, 2018	Dependency ParsingGeneral Classification	—Unverified
DLS@CU-CORE: A Simple Machine Learning Model of Semantic Textual Similarity	Jun 1, 2013	BIG-bench Machine LearningInformation Retrieval	—Unverified
DLS@CU at SemEval-2016 Task 1: Supervised Models of Sentence Similarity	Jun 1, 2016	Machine TranslationNatural Language Inference	—Unverified
BERT for Question Generation	Oct 1, 2019	Language ModelingLanguage Modelling	—Unverified
A Factoid Question Answering System Using Answer Pattern Matching	Oct 1, 2013	Question Answering	—Unverified
Challenges in Explanation Quality Evaluation	Oct 13, 2022	Question Answering	—Unverified
BERTERS: Multimodal Representation Learning for Expert Recommendation System with Transformer	Jun 30, 2020	ArticlesCommunity Question Answering	—Unverified
DLIP: Distilling Language-Image Pre-training	Aug 24, 2023	Image CaptioningImage-text Retrieval	—Unverified
3D-MoE: A Mixture-of-Experts Multi-modal LLM for 3D Vision and Pose Diffusion via Rectified Flow	Jan 28, 2025	Instruction FollowingMixture-of-Experts	—Unverified
BERT-CoQAC: BERT-based Conversational Question Answering in Context	Apr 23, 2021	Conversational Question AnsweringLanguage Modelling	—Unverified
DKPro Keyphrases: Flexible and Reusable Keyphrase Extraction Experiments	Jun 1, 2014	Information RetrievalKeyphrase Extraction	—Unverified
An Introduction to Natural Language Processing Techniques and Framework for Clinical Implementation in Radiation Oncology	Nov 3, 2023	DiagnosticQuestion Answering	—Unverified
DIVKNOWQA: Assessing the Reasoning Ability of LLMs via Open-Domain Question Answering over Knowledge Base and Text	Oct 31, 2023	Information RetrievalKnowledge Graphs	—Unverified
Divide & Conquer for Entailment-aware Multi-hop Evidence Retrieval	Nov 5, 2023	Information RetrievalMulti-hop Question Answering	—Unverified
A Factoid Question Answering System for Vietnamese	Mar 2, 2018	General KnowledgeQuestion Answering	—Unverified
Divide and Conquer: Text Semantic Matching with Disentangled Keywords and Intents	Jan 16, 2022	Community Question AnsweringInformation Retrieval	—Unverified
BERT Based Clinical Knowledge Extraction for Biomedical Knowledge Graph Construction and Analysis	Apr 21, 2023	Clinical Knowledgegraph construction	—Unverified
A Comprehensive Survey of Retrieval-Augmented Generation (RAG): Evolution, Current Landscape and Future Directions	Oct 3, 2024	Question AnsweringRAG	—Unverified
How Much Can CLIP Benefit Vision-and-Language Tasks?	Sep 29, 2021	Question AnsweringVisual Entailment	—Unverified
An Interactive Web-Interface for Visualizing the Inner Workings of the Question Answering LSTM	Nov 1, 2018	Feature EngineeringMachine Translation	—Unverified
Diversity Enhances an LLM's Performance in RAG and Long-context Task	Feb 13, 2025	DiversityQuestion Answering	—Unverified
How Generative-AI can be Effectively used in Government Chatbots	Nov 29, 2023	ChatbotQuestion Answering	—Unverified
BenLLMEval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP	Sep 22, 2023	Abstractive Text SummarizationNatural Language Inference	—Unverified
Diversity and Consistency: Exploring Visual Question-Answer Pair Generation	Nov 1, 2021	DiversityQuestion Answering	—Unverified
3DLLM-Mem: Long-Term Spatial-Temporal Memory for Embodied 3D Large Language Model	May 28, 2025	Language ModelingLanguage Modelling	—Unverified
How good are deep models in understanding the generated images?	Aug 23, 2022	ObjectObject Recognition	—Unverified
Diversify-verify-adapt: Efficient and Robust Retrieval-Augmented Ambiguous Question Answering	Sep 4, 2024	Question AnsweringRAG	—Unverified
Bengali Question Classification: Towards Developing QA System	Dec 1, 2012	ClassificationGeneral Classification	—Unverified
Diversifying the Mixture-of-Experts Representation for Language Models with Orthogonal Optimizer	Oct 15, 2023	DiversityMixture-of-Experts	—Unverified
Diversifying Question Generation over Knowledge Base via External Natural Questions	Sep 23, 2023	DiversityNatural Questions	—Unverified
An Interactive System for Exploring Community Question Answering Forums	Dec 1, 2016	Community Question AnsweringQuestion Answering	—Unverified
A Fact Checking and Verification System for FEVEROUS Using a Zero-Shot Learning Approach	Nov 1, 2021	Fact CheckingNatural Language Inference	—Unverified
How good are Large Language Models on African Languages?	Nov 14, 2023	In-Context LearningLanguage Modelling	—Unverified
Diversifying Knowledge Enhancement of Biomedical Language Models using Adapter Modules and Knowledge Graphs	Dec 21, 2023	Document ClassificationKnowledge Graphs	—Unverified
Diversifying Joint Vision-Language Tokenization Learning	Jun 6, 2023	Question AnsweringRepresentation Learning	—Unverified
Bend but Don't Break? Multi-Challenge Stress Test for QA Models	Nov 1, 2019	Question Answering	—Unverified
Benchmarks for Pirá 2.0, a Reading Comprehension Dataset about the Ocean, the Brazilian Coast, and Climate Change	Sep 19, 2023	Generative Question AnsweringInformation Retrieval	—Unverified
Diverse Multi-Answer Retrieval with Determinantal Point Processes	Nov 29, 2022	Open-Domain Question AnsweringPoint Processes	—Unverified
An Intelligent Question Answering System based on Power Knowledge Graph	Jun 16, 2021	Question Answering	—Unverified
A Comprehensive Survey of Knowledge-Based Vision Question Answering Systems: The Lifecycle of Knowledge in Visual Reasoning Task	Apr 24, 2025	Question AnsweringRetrieval	—Unverified
Diverse and Non-redundant Answer Set Extraction on Community QA based on DPPs	Nov 18, 2020	Point ProcessesQuestion Answering	—Unverified
Benchmarking Vision Language Models for Cultural Understanding	Jul 15, 2024	BenchmarkingQuestion Answering	—Unverified
Ditch the Gold Standard: Re-evaluating Conversational Question Answering	Oct 16, 2021	Conversational Question AnsweringQuestion Answering	—Unverified
Distributional Inclusion Vector Embedding for Unsupervised Hypernymy Detection	Oct 2, 2017	Hypernym DiscoveryQuestion Answering	—Unverified
An Initial Investigation of Non-Native Spoken Question-Answering	Jul 9, 2021	Question AnsweringReading Comprehension	—Unverified
Aesthetic Visual Question Answering of Photographs	Aug 10, 2022	Question AnsweringSentiment Analysis	—Unverified

Show:10 25 50

← PrevPage 84 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified