Question Answering

Question answering can be segmented into domain-specific tasks like community question answering and knowledge-base question answering. Popular benchmark datasets for evaluation question answering systems include SQuAD, HotPotQA, bAbI, TriviaQA, WikiQA, and many others. Models for question answering are typically evaluated on metrics like EM and F1. Some recent top performing models are T5 and XLNet.

( Image credit: SQuAD )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 6326–6350 of 10817 papers

Title	Date	Tasks	Status
Pre-training Transformer Models with Sentence-Level Objectives for Answer Sentence Selection	May 20, 2022	Answer SelectionQuestion Answering	—Unverified
Down and Across: Introducing Crossword-Solving as a New NLP Benchmark	May 20, 2022	Natural Language UnderstandingOpen-Domain Question Answering	CodeCode Available
Modeling Exemplification in Long-form Question Answering via Retrieval	May 19, 2022	FormLong Form Question Answering	—Unverified
Sentences as connection paths: A neural language architecture of sentence structure in the brain	May 19, 2022	Question AnsweringSentence	—Unverified
Modeling Multi-hop Question Answering as Single Sequence Prediction	May 18, 2022	Answer GenerationDecoder	—Unverified
A Birds Eye View on Knowledge Graph Embeddings, Software Libraries, Applications and Challenges	May 18, 2022	Information RetrievalKnowledge Graph Completion	—Unverified
Evaluation of Transfer Learning for Polish with a Text-to-Text Model	May 18, 2022	DecoderDenoising	—Unverified
ERNIE-Search: Bridging Cross-Encoder with Dual-Encoder via Self On-the-fly Distillation for Dense Passage Retrieval	May 18, 2022	Knowledge DistillationOpen-Domain Question Answering	—Unverified
Gender and Racial Bias in Visual Question Answering Datasets	May 17, 2022	Question AnsweringVisual Question Answering	—Unverified
Trustworthy Graph Neural Networks: Aspects, Methods and Trends	May 16, 2022	Drug DiscoveryEdge-computing	—Unverified
Miutsu: NTU's TaskBot for the Alexa Prize	May 16, 2022	Question AnsweringRetrieval	—Unverified
A Neuro-Symbolic ASP Pipeline for Visual Question Answering	May 16, 2022	Question AnsweringVisual Question Answering	CodeCode Available
Heroes, Villains, and Victims, and GPT-3: Automated Extraction of Character Roles Without Training Data	May 16, 2022	ArticlesQuestion Answering	—Unverified
Harnessing Multilingual Resources to Question Answering in Arabic	May 16, 2022	Question Answering	—Unverified
Not to Overfit or Underfit the Source Domains? An Empirical Study of Domain Generalization in Question Answering	May 15, 2022	Domain GeneralizationKnowledge Distillation	—Unverified
Modeling Semantic Composition with Syntactic Hypergraph for Video Question Answering	May 13, 2022	Question AnsweringSemantic Composition	—Unverified
Near-Negative Distinction: Giving a Second Life to Human Evaluation Datasets	May 13, 2022	nlg evaluationQuestion Answering	CodeCode Available
Towards Answering Open-ended Ethical Quandary Questions	May 12, 2022	Few-Shot LearningGenerative Question Answering	—Unverified
DTW at Qur'an QA 2022: Utilising Transfer Learning with Transformers for Question Answering in a Low-resource Domain	May 12, 2022	Ensemble LearningMachine Reading Comprehension	CodeCode Available
Lifting the Curse of Multilinguality by Pre-training Modular Transformers	May 12, 2022	named-entity-recognitionNamed Entity Recognition	—Unverified
Serving and Optimizing Machine Learning Workflows on Heterogeneous Infrastructures	May 10, 2022	AutoMLBIG-bench Machine Learning	—Unverified
Joint learning of object graph and relation graph for visual question answering	May 9, 2022	AttributeGraph Neural Network	—Unverified
Multilevel Hierarchical Network with Multiscale Sampling for Video Question Answering	May 9, 2022	multimodal interactionQuestion Answering	CodeCode Available
Chart Question Answering: State of the Art and Future Directions	May 8, 2022	Chart Question AnsweringQuestion Answering	—Unverified
Better Retrieval May Not Lead to Better Question Answering	May 7, 2022	Information RetrievalOpen-Domain Question Answering	—Unverified

Show:10 25 50

← PrevPage 254 of 433Next →

All datasets SQuAD2.0 SQuAD1.1 HotpotQA PIQA BoolQ COPA TriviaQA SQuAD1.1 dev Natural Questions OpenBookQA TruthfulQA MultiRC

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	IE-Net (ensemble)	EM	90.94	—	Unverified
2	FPNet (ensemble)	EM	90.87	—	Unverified
3	IE-NetV2 (ensemble)	EM	90.86	—	Unverified
4	SA-Net on Albert (ensemble)	EM	90.72	—	Unverified
5	SA-Net-V2 (ensemble)	EM	90.68	—	Unverified
6	FPNet (ensemble)	EM	90.6	—	Unverified
7	Retro-Reader (ensemble)	EM	90.58	—	Unverified
8	EntitySpanFocusV2 (ensemble)	EM	90.52	—	Unverified
9	TransNets + SFVerifier + SFEnsembler (ensemble)	EM	90.49	—	Unverified
10	EntitySpanFocus+AT (ensemble)	EM	90.45	—	Unverified