SOTAVerified

Open-Domain Question Answering

Open-domain question answering is the task of question answering on open-domain datasets such as Wikipedia.

Papers

Showing 376–400 of 494 papers

TitleStatusHype
SPLADE: Sparse Lexical and Expansion Model for First Stage Ranking—0
Stochastic RAG: End-to-End Retrieval-Augmented Generation through Expected Utility Maximization—0
Strong and Efficient Baselines for Open Domain Conversational Question Answering—0
Talk to Papers: Bringing Neural Question Answering to Academic Search—0
Targeted Extraction of Temporal Facts from Textual Resources for Improved Temporal Question Answering over Knowledge Bases—0
Text Embeddings for Retrieval From a Large Knowledge Base—0
DuReader_vis: A Chinese Dataset for Open-domain Document Visual Question Answering—0
The Dangers of trusting Stochastic Parrots: Faithfulness and Trust in Open-domain Conversational Question Answering—0
The Inductive Bias of In-Context Learning: Rethinking Pretraining Example Design—0
To Adapt or to Annotate: Challenges and Interventions for Domain Adaptation in Open-Domain Question Answering—0
Towards an open-domain conversational system fully based on natural language processing—0
Towards Better Generalization in Open-Domain Question Answering by Mitigating Context Memorization—0
Towards Human-Level Understanding of Complex Process Engineering Schematics: A Pedagogical, Introspective Multi-Agent Framework for Open-Domain Question Answering—0
Towards Robust Evaluation: A Comprehensive Taxonomy of Datasets and Metrics for Open Domain Question Answering in the Era of Large Language Models—0
Towards Universal Dense Retrieval for Open-domain Question Answering—0
Tradeoffs in Sentence Selection Techniques for Open-Domain Question Answering—0
Training a Ranking Function for Open-Domain Question Answering—0
UniK-QA: Unified Representations of Structured and Unstructured Knowledge for Open-Domain Question Answering—0
UnitedQA: A Hybrid Approach for Open Domain Question Answering—0
Unsupervised Open-Domain Question Answering—0
Unsupervised Open-Domain Question Answering with Higher Answerability—0
Unveiling Knowledge Utilization Mechanisms in LLM-based Retrieval-Augmented Generation—0
Watson Discovery Advisor: Question-answering in an industrial setting—0
Weaver: Deep Co-Encoding of Questions and Documents for Machine Reading—0
WebFAQ: A Multilingual Collection of Natural Q&A Datasets for Dense Retrieval—0
Show:102550
← PrevPage 16 of 20Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1somebodyKILT-RL2.62—Unverified
2WikipediaKILT-RL2.46—Unverified
3arxiv.org/abs/2103.06332KILT-RL2.36—Unverified
4BART + DPRKILT-RL1.9—Unverified
5RAGKILT-RL1.69—Unverified
6Training Set Retrieval (top 1)KILT-RL0—Unverified
7T5-baseKILT-RL0—Unverified
8Input CopyingKILT-RL0—Unverified
9SphereKILT-RL0—Unverified
10Random Training Set AnswerKILT-RL0—Unverified
#ModelMetricClaimedVerifiedStatus
1Re2GKILT-EM43.56—Unverified
2intersectKILT-EM38.78—Unverified
3KGI_0KILT-EM36.36—Unverified
4WikipediaKILT-EM35.32—Unverified
5RAGKILT-EM32.69—Unverified
6BERT + DPRKILT-EM31.99—Unverified
7BART + DPRKILT-EM30.06—Unverified
8Multitask DPR + BARTKILT-EM29.09—Unverified
9Multi-task DPRKILT-EM0—Unverified
10SphereKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1Re2GKILT-EM57.91—Unverified
2intersectKILT-EM50.56—Unverified
3WikipediaKILT-EM45.55—Unverified
4KGI_0KILT-EM42.85—Unverified
5Multitask DPR + BARTKILT-EM42.36—Unverified
6RAGKILT-EM38.13—Unverified
7BERT + DPRKILT-EM34.48—Unverified
8BART + DPRKILT-EM31.4—Unverified
9TABiKILT-EM0—Unverified
10T5-baseKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1intersectKILT-EM18.06—Unverified
2WikipediaKILT-EM11.71—Unverified
3Multitask DPR + BARTKILT-EM9.53—Unverified
4RAGKILT-EM3.21—Unverified
5BART + DPRKILT-EM1.96—Unverified
6BERT + DPRKILT-EM0.74—Unverified
7SphereKILT-EM0—Unverified
8Multi-task DPRKILT-EM0—Unverified
9GENREKILT-EM0—Unverified
10chriskueiKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1SpanBERTF184.8—Unverified
2Cluster-Former (#C=512)EM68—Unverified
3Locality-Sensitive HashingEM66—Unverified
4Multi-passage BERTEM65.1—Unverified
5Sparse AttentionEM64.7—Unverified
6DECAPROPEM62.2—Unverified
7Bi-Attention + DCU-LSTMN-gram F159.5—Unverified
8Denoising QAEM58.8—Unverified
9DecaPropEM56.8—Unverified
10AMANDAN-gram F156.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Fourier TransformerRouge-L26.9—Unverified
2QGRouge-L26.4—Unverified
3BARTRouge-L24.3—Unverified
4E-MCARouge-L24—Unverified
5Transformer Multitask + LayerDropRouge-L23.4—Unverified
6Multi-InrerleaveRouge-L14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1Evidence Aggregation via R^3 Re-RankingEM (Quasar-T)42.3—Unverified
2Denoising QAEM (Quasar-T)42.2—Unverified
3DecaPropEM (Quasar-T)38.6—Unverified
4R^3EM (Quasar-T)35.3—Unverified
5GAEM (Quasar-T)26.4—Unverified
6BiDAFEM (Quasar-T)25.9—Unverified
#ModelMetricClaimedVerifiedStatus
1FiEExact Match58.4—Unverified
2R2-D2 HN-DPRExact Match55.9—Unverified
3UniK-QAExact Match54.9—Unverified
4UnitedQA (Hybrid)Exact Match54.7—Unverified
5BPR (linear scan; l=1000)Exact Match41.6—Unverified
#ModelMetricClaimedVerifiedStatus
1SPARTAEM59.3—Unverified
2Blended RAGEM57.63—Unverified
3BERTseriniEM50.2—Unverified
4BERTseriniEM38.6—Unverified
#ModelMetricClaimedVerifiedStatus
1UniK-QAExact Match57.7—Unverified
2FiE+PAQExact Match56.3—Unverified
3FiEExact Match52.4—Unverified
4EMDR2Exact Match48.7—Unverified
#ModelMetricClaimedVerifiedStatus
1DrQAEM70—Unverified
2DCNEM66.2—Unverified
3MPCMEM65.5—Unverified
#ModelMetricClaimedVerifiedStatus
1ERNIE 2.0 LargeEM64.2—Unverified
2ERNIE 2.0 BaseEM61.3—Unverified
#ModelMetricClaimedVerifiedStatus
1UniK-QAExact Match65.5—Unverified
2BPR (linear scan; l=1000)Exact Match56.8—Unverified
#ModelMetricClaimedVerifiedStatus
1EMDR2Exact Match52.5—Unverified
#ModelMetricClaimedVerifiedStatus
1UnitedQA (Hybrid)Exact Match70.5—Unverified