Open-Domain Question Answering

Open-domain question answering is the task of question answering on open-domain datasets such as Wikipedia.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 251–275 of 494 papers

Title	Date	Tasks	Status
Allies: Prompting Large Language Model with Beam Search	May 24, 2023	Language ModelingLanguage Modelling	—Unverified
IfQA: A Dataset for Open-domain Question Answering under Counterfactual Presuppositions	May 23, 2023	counterfactualCounterfactual Reasoning	—Unverified
Exploring Contrast Consistency of Open-Domain Question Answering Systems on Minimally Edited Questions	May 23, 2023	Data AugmentationLanguage Modeling	CodeCode Available
MAUPQA: Massive Automatically-created Polish Question Answering Dataset	May 9, 2023	Open-Domain Question AnsweringPassage Retrieval	—Unverified
Why Does ChatGPT Fall Short in Providing Truthful Answers?	Apr 20, 2023	MemorizationOpen-Domain Question Answering	—Unverified
Evidentiality-aware Retrieval for Overcoming Abstractiveness in Open-Domain Question Answering	Apr 6, 2023	Contrastive Learningcounterfactual	—Unverified
Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback	Feb 24, 2023	InformativenessOpen-Domain Question Answering	—Unverified
RLAS-BIABC: A Reinforcement Learning-Based Answer Selection Using the BERT Model Boosted by an Improved ABC Algorithm	Jan 7, 2023	Answer SelectionDecision Making	—Unverified
Beyond Contrastive Learning: A Variational Generative Model for Multilingual Retrieval	Dec 21, 2022	Contrastive LearningOpen-Domain Question Answering	—Unverified
Defending Against Disinformation Attacks in Open-Domain Question Answering	Dec 20, 2022	Data PoisoningMisinformation	CodeCode Available
To Adapt or to Annotate: Challenges and Interventions for Domain Adaptation in Open-Domain Question Answering	Dec 20, 2022	Domain AdaptationOpen-Domain Question Answering	—Unverified
PolQA: Polish Question Answering Dataset	Dec 17, 2022	Open-Domain Question AnsweringPassage Retrieval	—Unverified
AugTriever: Unsupervised Dense Retrieval and Domain Adaptation by Scalable Data Augmentation	Dec 17, 2022	Data AugmentationDomain Adaptation	CodeCode Available
NIR-Prompt: A Multi-task Generalized Neural Information Retrieval Training Framework	Dec 1, 2022	Information RetrievalOpen-Domain Question Answering	CodeCode Available
Diverse Multi-Answer Retrieval with Determinantal Point Processes	Nov 29, 2022	Open-Domain Question AnsweringPoint Processes	—Unverified
Can Open-Domain QA Reader Utilize External Knowledge Efficiently like Humans?	Nov 23, 2022	Open-Domain Question AnsweringTriviaQA	—Unverified
FiE: Building a Global Probability Space by Leveraging Early Fusion in Encoder for Open-Domain Question Answering	Nov 18, 2022	Data AugmentationDecoder	—Unverified
Cheater's Bowl: Human vs. Computer Search Strategies for Open-Domain Question Answering	Nov 15, 2022	Open-Domain Question AnsweringQuestion Answering	—Unverified
A Survey for Efficient Open Domain Question Answering	Nov 15, 2022	Open-Domain Question AnsweringQuestion Answering	—Unverified
Bridging the Training-Inference Gap for Dense Phrase Retrieval	Oct 25, 2022	Open-Domain Question AnsweringPassage Retrieval	—Unverified
Closed-book Question Generation via Contrastive Learning	Oct 13, 2022	Contrastive LearningNatural Questions	CodeCode Available
Context Generation Improves Open Domain Question Answering	Oct 12, 2022	Language ModelingLanguage Modelling	—Unverified
Decoupled Context Processing for Context Augmented Language Modeling	Oct 11, 2022	DecoderLanguage Modeling	—Unverified
Improving the Domain Adaptation of Retrieval Augmented Generation (RAG) Models for Open Domain Question Answering	Oct 6, 2022	Domain AdaptationInformation Retrieval	—Unverified
FiD-Light: Efficient and Effective Retrieval-Augmented Text Generation	Sep 28, 2022	DecoderOpen-Domain Question Answering	—Unverified

Show:10 25 50

← PrevPage 11 of 20Next →

All datasets KILT: ELI5 KILT: Natural Questions KILT: TriviaQA KILT: HotpotQA SearchQA ELI5 QUASAR Natural Questions SQuAD1.1 dev WebQuestions SQuAD1.1 DuReader

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	somebody	KILT-RL	2.62	—	Unverified
2	Wikipedia	KILT-RL	2.46	—	Unverified
3	arxiv.org/abs/2103.06332	KILT-RL	2.36	—	Unverified
4	BART + DPR	KILT-RL	1.9	—	Unverified
5	RAG	KILT-RL	1.69	—	Unverified
6	Training Set Retrieval (top 1)	KILT-RL	0	—	Unverified
7	T5-base	KILT-RL	0	—	Unverified
8	Input Copying	KILT-RL	0	—	Unverified
9	Sphere	KILT-RL	0	—	Unverified
10	Random Training Set Answer	KILT-RL	0	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Re2G	KILT-EM	43.56	—	Unverified
2	intersect	KILT-EM	38.78	—	Unverified
3	KGI_0	KILT-EM	36.36	—	Unverified
4	Wikipedia	KILT-EM	35.32	—	Unverified
5	RAG	KILT-EM	32.69	—	Unverified
6	BERT + DPR	KILT-EM	31.99	—	Unverified
7	BART + DPR	KILT-EM	30.06	—	Unverified
8	Multitask DPR + BART	KILT-EM	29.09	—	Unverified
9	Multi-task DPR	KILT-EM	0	—	Unverified
10	Sphere	KILT-EM	0	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Re2G	KILT-EM	57.91	—	Unverified
2	intersect	KILT-EM	50.56	—	Unverified
3	Wikipedia	KILT-EM	45.55	—	Unverified
4	KGI_0	KILT-EM	42.85	—	Unverified
5	Multitask DPR + BART	KILT-EM	42.36	—	Unverified
6	RAG	KILT-EM	38.13	—	Unverified
7	BERT + DPR	KILT-EM	34.48	—	Unverified
8	BART + DPR	KILT-EM	31.4	—	Unverified
9	TABi	KILT-EM	0	—	Unverified
10	T5-base	KILT-EM	0	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	intersect	KILT-EM	18.06	—	Unverified
2	Wikipedia	KILT-EM	11.71	—	Unverified
3	Multitask DPR + BART	KILT-EM	9.53	—	Unverified
4	RAG	KILT-EM	3.21	—	Unverified
5	BART + DPR	KILT-EM	1.96	—	Unverified
6	BERT + DPR	KILT-EM	0.74	—	Unverified
7	Sphere	KILT-EM	0	—	Unverified
8	Multi-task DPR	KILT-EM	0	—	Unverified
9	GENRE	KILT-EM	0	—	Unverified
10	chriskuei	KILT-EM	0	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpanBERT	F1	84.8	—	Unverified
2	Cluster-Former (#C=512)	EM	68	—	Unverified
3	Locality-Sensitive Hashing	EM	66	—	Unverified
4	Multi-passage BERT	EM	65.1	—	Unverified
5	Sparse Attention	EM	64.7	—	Unverified
6	DECAPROP	EM	62.2	—	Unverified
7	Bi-Attention + DCU-LSTM	N-gram F1	59.5	—	Unverified
8	Denoising QA	EM	58.8	—	Unverified
9	DecaProp	EM	56.8	—	Unverified
10	AMANDA	N-gram F1	56.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Fourier Transformer	Rouge-L	26.9	—	Unverified
2	QG	Rouge-L	26.4	—	Unverified
3	BART	Rouge-L	24.3	—	Unverified
4	E-MCA	Rouge-L	24	—	Unverified
5	Transformer Multitask + LayerDrop	Rouge-L	23.4	—	Unverified
6	Multi-Inrerleave	Rouge-L	14.63	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Evidence Aggregation via R^3 Re-Ranking	EM (Quasar-T)	42.3	—	Unverified
2	Denoising QA	EM (Quasar-T)	42.2	—	Unverified
3	DecaProp	EM (Quasar-T)	38.6	—	Unverified
4	R^3	EM (Quasar-T)	35.3	—	Unverified
5	GA	EM (Quasar-T)	26.4	—	Unverified
6	BiDAF	EM (Quasar-T)	25.9	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	FiE	Exact Match	58.4	—	Unverified
2	R2-D2 HN-DPR	Exact Match	55.9	—	Unverified
3	UniK-QA	Exact Match	54.9	—	Unverified
4	UnitedQA (Hybrid)	Exact Match	54.7	—	Unverified
5	BPR (linear scan; l=1000)	Exact Match	41.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SPARTA	EM	59.3	—	Unverified
2	Blended RAG	EM	57.63	—	Unverified
3	BERTserini	EM	50.2	—	Unverified
4	BERTserini	EM	38.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UniK-QA	Exact Match	57.7	—	Unverified
2	FiE+PAQ	Exact Match	56.3	—	Unverified
3	FiE	Exact Match	52.4	—	Unverified
4	EMDR2	Exact Match	48.7	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DrQA	EM	70	—	Unverified
2	DCN	EM	66.2	—	Unverified
3	MPCM	EM	65.5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	ERNIE 2.0 Large	EM	64.2	—	Unverified
2	ERNIE 2.0 Base	EM	61.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UniK-QA	Exact Match	65.5	—	Unverified
2	BPR (linear scan; l=1000)	Exact Match	56.8	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	EMDR2	Exact Match	52.5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	UnitedQA (Hybrid)	Exact Match	70.5	—	Unverified