Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5251–5275 of 10817 papers

Title	Date	Tasks	Status	Hype
LAVIS: A Library for Language-Vision Intelligence	Sep 15, 2022	BenchmarkingImage Captioning	—Unverified	0
OmniVL:One Foundation Model for Image-Language and Video-Language Tasks	Sep 15, 2022	Action ClassificationAction Recognition	—Unverified	0
MUST-VQA: MUltilingual Scene-text VQA	Sep 14, 2022	Question AnsweringVisual Question Answering	—Unverified	0
Correlation Information Bottleneck: Towards Adapting Pretrained Multimodal Models for Robust Visual Question Answering	Sep 14, 2022	Adversarial RobustnessQuestion Answering	—Unverified	0
Pre-training for Information Retrieval: Are Hyperlinks Fully Explored?	Sep 14, 2022	Information RetrievalQuestion Answering	—Unverified	0
UIT-ViCoV19QA: A Dataset for COVID-19 Community-based Question Answering on Vietnamese Language	Sep 14, 2022	Question Answering	CodeCode Available	0
Prompt-based Conservation Learning for Multi-hop Question Answering	Sep 14, 2022	Multi-hop Question AnsweringQuestion Answering	—Unverified	0
PaLI: A Jointly-Scaled Multilingual Language-Image Model	Sep 14, 2022	DecoderFew-Shot Image Classification	—Unverified	0
WildQA: In-the-Wild Video Question Answering	Sep 14, 2022	Evidence SelectionQuestion Answering	—Unverified	0
KSG: Knowledge and Skill Graph	Sep 13, 2022	AttributeDeep Reinforcement Learning	—Unverified	0
MaXM: Towards Multilingual Visual Question Answering	Sep 12, 2022	Question AnsweringTranslation	CodeCode Available	1
PreSTU: Pre-Training for Scene-Text Understanding	Sep 12, 2022	DecoderImage Captioning	—Unverified	0
Domain Adaptation for Question Answering via Question Classification	Sep 12, 2022	Domain AdaptationGeneral Classification	CodeCode Available	0
Knowledge Base Question Answering: A Semantic Parsing Perspective	Sep 12, 2022	AttributeKnowledge Base Question Answering	—Unverified	0
Evaluation of Question Answering Systems: Complexity of judging a natural language	Sep 10, 2022	Question AnsweringWord Embeddings	—Unverified	0
Activity report analysis with automatic single or multispan answer extraction	Sep 9, 2022	Anomaly DetectionQuestion Answering	—Unverified	0
Pre-training image-language transformers for open-vocabulary tasks	Sep 9, 2022	Question AnsweringVisual Entailment	—Unverified	0
Frame-Subtitle Self-Supervision for Multi-Modal Video Question Answering	Sep 8, 2022	Question AnsweringVideo Question Answering	—Unverified	0
Knowledge-enhanced Iterative Instruction Generation and Reasoning for Knowledge Base Question Answering	Sep 7, 2022	Knowledge Base Question AnsweringQuestion Answering	—Unverified	0
Improving the Cross-Lingual Generalisation in Visual Question Answering	Sep 7, 2022	Cross-Lingual TransferQuestion Answering	CodeCode Available	0
The BLue Amazon Brain (BLAB): A Modular Architecture of Services about the Brazilian Maritime Territory	Sep 6, 2022	Question Answering	CodeCode Available	0
Query-focused Extractive Summarisation for Biomedical and COVID-19 Complex Question Answering	Sep 5, 2022	Question AnsweringRe-Ranking	CodeCode Available	0
An Empirical Study of End-to-End Video-Language Transformers with Masked Visual Modeling	Sep 4, 2022	Fill MaskOptical Flow Estimation	CodeCode Available	1
Interactive Question Answering Systems: Literature Review	Sep 4, 2022	Question Answering	—Unverified	0
Elaboration-Generating Commonsense Question Answering at Scale	Sep 2, 2022	Common Sense ReasoningQuestion Answering	CodeCode Available	0

Show:10 25 50

← PrevPage 211 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified