Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 10101–10125 of 10817 papers

Title	Date	Tasks	Status
Look, Read and Enrich. Learning from Scientific Figures and their Captions	Sep 19, 2019	Multi-modal ClassificationQuestion Answering	CodeCode Available
Choice Fusion as Knowledge for Zero-Shot Dialogue State Tracking	Feb 25, 2023	DecoderDialogue State Tracking	CodeCode Available
ProCQA: A Large-scale Community-based Programming Question Answering Dataset for Code Search	Mar 25, 2024	Code SearchQuestion Answering	CodeCode Available
CHIRON: Rich Character Representations in Long-Form Narratives	Jun 14, 2024	FormQuestion Answering	CodeCode Available
Embodied Question Answering	Nov 30, 2017	Embodied Question AnsweringNavigate	CodeCode Available
Chinese Parsing Exploiting Characters	Aug 1, 2013	Information RetrievalMachine Translation	CodeCode Available
Loss re-scaling VQA: Revisiting the LanguagePrior Problem from a Class-imbalance View	Oct 30, 2020	Face Recognitionimage-classification	CodeCode Available
Ember: No-Code Context Enrichment via Similarity-Based Keyless Joins	Jun 2, 2021	Question AnsweringRepresentation Learning	CodeCode Available
ChiMed: A Chinese Medical Corpus for Question Answering	Aug 1, 2019	Question Answering	CodeCode Available
ANTIQUE: A Non-Factoid Question Answering Benchmark	May 22, 2019	Community Question AnsweringInformation Retrieval	CodeCode Available
Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language Resamplers	Apr 21, 2024	DiagnosticImage Captioning	CodeCode Available
Lost in the Middle, and In-Between: Enhancing Language Models' Ability to Reason Over Long Contexts in Multi-Hop QA	Dec 13, 2024	Multi-hop Question AnsweringQuestion Answering	CodeCode Available
Embedding Uncertain Knowledge Graphs	Nov 26, 2018	Binary ClassificationGeneral Classification	CodeCode Available
ELQA: A Corpus of Metalinguistic Questions and Answers about English	May 1, 2022	Answer GenerationQuestion Answering	CodeCode Available
Ellipsis Resolution as Question Answering: An Evaluation	Aug 29, 2019	coreference-resolutionCoreference Resolution	CodeCode Available
Object Attribute Matters in Visual Question Answering	Dec 20, 2023	AttributeGraph Neural Network	CodeCode Available
Object-aware Adaptive-Positivity Learning for Audio-Visual Question Answering	Dec 20, 2023	Audio-visual Question AnsweringAudio-Visual Question Answering (AVQA)	CodeCode Available
Product-Aware Answer Generation in E-Commerce Question-Answering	Jan 23, 2019	Answer GenerationQuestion Answering	CodeCode Available
Answer Them All! Toward Universal Visual Question Answering Models	Mar 1, 2019	AllQuestion Answering	CodeCode Available
RAMQA: A Unified Framework for Retrieval-Augmented Multi-Modal Question Answering	Jan 23, 2025	DecoderInformation Retrieval	CodeCode Available
RA-MTR: A Retrieval Augmented Multi-Task Reader based Approach for Inspirational Quote Extraction from Long Documents	Feb 17, 2025	ArticlesOpen-Domain Question Answering	CodeCode Available
LPF: A Language-Prior Feedback Objective Function for De-biased Visual Question Answering	May 29, 2021	Question AnsweringVisual Question Answering	CodeCode Available
LP-LM: No Hallucinations in Question Answering with Logic Programming	Feb 13, 2025	Question AnsweringSemantic Parsing	CodeCode Available
ActBERT: Learning Global-Local Video-Text Representations	Nov 14, 2020	Action SegmentationQuestion Answering	CodeCode Available
Eliciting Bias in Question Answering Models through Ambiguity	Nov 1, 2021	ArticlesQuestion Answering	CodeCode Available

Show:10 25 50

← PrevPage 405 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified