Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 5551–5600 of 10817 papers

Title	Date	Tasks	Status	Hype
NS3: Neuro-Symbolic Semantic Code Search	May 21, 2022	Code SearchQuestion Answering	CodeCode Available	0
Least-to-Most Prompting Enables Complex Reasoning in Large Language Models	May 21, 2022	Arithmetic ReasoningMath	—Unverified	0
Pre-training Transformer Models with Sentence-Level Objectives for Answer Sentence Selection	May 20, 2022	Answer SelectionQuestion Answering	—Unverified	0
Down and Across: Introducing Crossword-Solving as a New NLP Benchmark	May 20, 2022	Natural Language UnderstandingOpen-Domain Question Answering	CodeCode Available	0
Transition-based Semantic Role Labeling with Pointer Networks	May 20, 2022	Machine TranslationQuestion Answering	CodeCode Available	0
Sentences as connection paths: A neural language architecture of sentence structure in the brain	May 19, 2022	Question AnsweringSentence	—Unverified	0
Table Retrieval May Not Necessitate Table-specific Model Design	May 19, 2022	Hard AttentionNatural Questions	CodeCode Available	1
Modeling Exemplification in Long-form Question Answering via Retrieval	May 19, 2022	FormLong Form Question Answering	—Unverified	0
Automated Crossword Solving	May 19, 2022	Question Answering	CodeCode Available	1
A Birds Eye View on Knowledge Graph Embeddings, Software Libraries, Applications and Challenges	May 18, 2022	Information RetrievalKnowledge Graph Completion	—Unverified	0
Modeling Multi-hop Question Answering as Single Sequence Prediction	May 18, 2022	Answer GenerationDecoder	—Unverified	0
Evaluation of Transfer Learning for Polish with a Text-to-Text Model	May 18, 2022	DecoderDenoising	—Unverified	0
ERNIE-Search: Bridging Cross-Encoder with Dual-Encoder via Self On-the-fly Distillation for Dense Passage Retrieval	May 18, 2022	Knowledge DistillationOpen-Domain Question Answering	—Unverified	0
Entailment Tree Explanations via Iterative Retrieval-Generation Reasoner	May 18, 2022	DecoderQuestion Answering	CodeCode Available	1
Dialog Inpainting: Turning Documents into Dialogs	May 18, 2022	Conversational Question AnsweringQuestion Answering	CodeCode Available	1
Gender and Racial Bias in Visual Question Answering Datasets	May 17, 2022	Question AnsweringVisual Question Answering	—Unverified	0
A Neuro-Symbolic ASP Pipeline for Visual Question Answering	May 16, 2022	Question AnsweringVisual Question Answering	CodeCode Available	0
Trustworthy Graph Neural Networks: Aspects, Methods and Trends	May 16, 2022	Drug DiscoveryEdge-computing	—Unverified	0
Heroes, Villains, and Victims, and GPT-3: Automated Extraction of Character Roles Without Training Data	May 16, 2022	ArticlesQuestion Answering	—Unverified	0
Harnessing Multilingual Resources to Question Answering in Arabic	May 16, 2022	Question Answering	—Unverified	0
Miutsu: NTU's TaskBot for the Alexa Prize	May 16, 2022	Question AnsweringRetrieval	—Unverified	0
Not to Overfit or Underfit the Source Domains? An Empirical Study of Domain Generalization in Question Answering	May 15, 2022	Domain GeneralizationKnowledge Distillation	—Unverified	0
Near-Negative Distinction: Giving a Second Life to Human Evaluation Datasets	May 13, 2022	nlg evaluationQuestion Answering	CodeCode Available	0
Modeling Semantic Composition with Syntactic Hypergraph for Video Question Answering	May 13, 2022	Question AnsweringSemantic Composition	—Unverified	0
Knowledge Graph Question Answering Datasets and Their Generalizability: Are They Enough for Future Research?	May 13, 2022	Graph Question AnsweringKnowledge Graphs	CodeCode Available	1
Towards Answering Open-ended Ethical Quandary Questions	May 12, 2022	Few-Shot LearningGenerative Question Answering	—Unverified	0
Lifting the Curse of Multilinguality by Pre-training Modular Transformers	May 12, 2022	named-entity-recognitionNamed Entity Recognition	—Unverified	0
DTW at Qur'an QA 2022: Utilising Transfer Learning with Transformers for Question Answering in a Low-resource Domain	May 12, 2022	Ensemble LearningMachine Reading Comprehension	CodeCode Available	0
UL2: Unifying Language Learning Paradigms	May 10, 2022	Arithmetic ReasoningCommon Sense Reasoning	CodeCode Available	1
Serving and Optimizing Machine Learning Workflows on Heterogeneous Infrastructures	May 10, 2022	AutoMLBIG-bench Machine Learning	—Unverified	0
Learning to Answer Visual Questions from Web Videos	May 10, 2022	Dataset GenerationQuestion Answering	CodeCode Available	1
Multilevel Hierarchical Network with Multiscale Sampling for Video Question Answering	May 9, 2022	multimodal interactionQuestion Answering	CodeCode Available	0
Joint learning of object graph and relation graph for visual question answering	May 9, 2022	AttributeGraph Neural Network	—Unverified	0
ProQA: Structural Prompt-based Pre-training for Unified Question Answering	May 9, 2022	Continual LearningFew-Shot Learning	CodeCode Available	1
Chart Question Answering: State of the Art and Future Directions	May 8, 2022	Chart Question AnsweringQuestion Answering	—Unverified	0
Better Retrieval May Not Lead to Better Question Answering	May 7, 2022	Information RetrievalOpen-Domain Question Answering	—Unverified	0
Improving Downstream Task Performance by Treating Numbers as Entities	May 7, 2022	ClassificationQuestion Answering	—Unverified	0
The Unreliability of Explanations in Few-shot Prompting for Textual Reasoning	May 6, 2022	In-Context LearningLanguage Modelling	CodeCode Available	1
Translating Place-Related Questions to GeoSPARQL Queries	May 6, 2022	Geographic Question AnsweringQuestion Answering	CodeCode Available	0
From Easy to Hard: Learning Language-guided Curriculum for Visual Question Answering on Remote Sensing Data	May 6, 2022	Question AnsweringVisual Question Answering	—Unverified	0
KECP: Knowledge Enhanced Contrastive Prompting for Few-shot Extractive Question Answering	May 6, 2022	Contrastive LearningExtractive Question-Answering	—Unverified	0
QLEVR: A Diagnostic Dataset for Quantificational Language and Elementary Visual Reasoning	May 6, 2022	DiagnosticQuestion Answering	CodeCode Available	0
METGEN: A Module-Based Entailment Tree Generation Framework for Answer Explanation	May 5, 2022	Question Answeringvalid	CodeCode Available	1
What is Right for Me is Not Yet Right for You: A Dataset for Grounding Relative Directions via Multi-Task Learning	May 5, 2022	Multi-Task LearningQuestion Answering	CodeCode Available	0
Declaration-based Prompt Tuning for Visual Question Answering	May 5, 2022	Image-text matchingLanguage Modeling	CodeCode Available	1
KenSwQuAD -- A Question Answering Dataset for Swahili Low Resource Language	May 4, 2022	BIG-bench Machine LearningQuestion Answering	—Unverified	0
Analysing the Robustness of Dual Encoders for Dense Retrieval Against Misspellings	May 4, 2022	Contrastive LearningData Augmentation	CodeCode Available	0
Hybrid Transformer with Multi-level Fusion for Multimodal Knowledge Graph Completion	May 4, 2022	Information RetrievalKnowledge Graph Completion	CodeCode Available	2
Compositional Task-Oriented Parsing as Abstractive Question Answering	May 4, 2022	abstractive question answeringQuestion Answering	CodeCode Available	0
All You May Need for VQA are Image Captions	May 4, 2022	AllImage Captioning	CodeCode Available	3

Show:10 25 50

← PrevPage 112 of 217Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified