SOTAVerified

Open-Domain Question Answering

Open-domain question answering is the task of question answering on open-domain datasets such as Wikipedia.

Papers

Showing 226–250 of 494 papers

TitleStatusHype
Bridging the Training-Inference Gap for Dense Phrase Retrieval—0
Building Interpretable and Reliable Open Information Retriever for New Domains Overnight—0
Calibration of Machine Reading Systems at Scale—0
Calibration of Machine Reading Systems at Scale—0
CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation—0
Can Open-Domain QA Reader Utilize External Knowledge Efficiently like Humans?—0
Can Open Domain Question Answering Systems Answer Visual Knowledge Questions?—0
CCQA: A New Web-Scale Question Answering Dataset for Model Pre-Training—0
CFMatch: Aligning Automated Answer Equivalence Evaluation with Expert Judgments For Open-Domain Question Answering—0
Challenges in Generalization in Open Domain Question Answering—0
Cheater's Bowl: Human vs. Computer Search Strategies for Open-Domain Question Answering—0
Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback—0
Chinese Open Relation Extraction for Knowledge Acquisition—0
Cluster-Former: Clustering-based Sparse Transformer for Long-Range Dependency Encoding—0
C-MORE: Pretraining to Answer Open-Domain Questions by Consulting Millions of References—0
Combining Lexical and Semantic-based Features for Answer Sentence Selection—0
Combining Open Domain Question Answering with a Task-Oriented Dialog System—0
Complementary Evidence Identification in Open-Domain Question Answering—0
Compositional De-Attention Networks—0
Compositional Learning of Embeddings for Relation Paths in Knowledge Base and Text—0
Compressing Long Context for Enhancing RAG with AMR-based Concept Distillation—0
Context-Based Quotation Recommendation—0
Context Generation Improves Open Domain Question Answering—0
Context Quality Matters in Training Fusion-in-Decoder for Extractive Open-Domain Question Answering—0
Contextualized Query Embeddings for Conversational Search—0
Show:102550
← PrevPage 10 of 20Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1somebodyKILT-RL2.62—Unverified
2WikipediaKILT-RL2.46—Unverified
3arxiv.org/abs/2103.06332KILT-RL2.36—Unverified
4BART + DPRKILT-RL1.9—Unverified
5RAGKILT-RL1.69—Unverified
6Training Set Retrieval (top 1)KILT-RL0—Unverified
7T5-baseKILT-RL0—Unverified
8Input CopyingKILT-RL0—Unverified
9SphereKILT-RL0—Unverified
10Random Training Set AnswerKILT-RL0—Unverified
#ModelMetricClaimedVerifiedStatus
1Re2GKILT-EM43.56—Unverified
2intersectKILT-EM38.78—Unverified
3KGI_0KILT-EM36.36—Unverified
4WikipediaKILT-EM35.32—Unverified
5RAGKILT-EM32.69—Unverified
6BERT + DPRKILT-EM31.99—Unverified
7BART + DPRKILT-EM30.06—Unverified
8Multitask DPR + BARTKILT-EM29.09—Unverified
9Multi-task DPRKILT-EM0—Unverified
10SphereKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1Re2GKILT-EM57.91—Unverified
2intersectKILT-EM50.56—Unverified
3WikipediaKILT-EM45.55—Unverified
4KGI_0KILT-EM42.85—Unverified
5Multitask DPR + BARTKILT-EM42.36—Unverified
6RAGKILT-EM38.13—Unverified
7BERT + DPRKILT-EM34.48—Unverified
8BART + DPRKILT-EM31.4—Unverified
9TABiKILT-EM0—Unverified
10T5-baseKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1intersectKILT-EM18.06—Unverified
2WikipediaKILT-EM11.71—Unverified
3Multitask DPR + BARTKILT-EM9.53—Unverified
4RAGKILT-EM3.21—Unverified
5BART + DPRKILT-EM1.96—Unverified
6BERT + DPRKILT-EM0.74—Unverified
7SphereKILT-EM0—Unverified
8Multi-task DPRKILT-EM0—Unverified
9GENREKILT-EM0—Unverified
10chriskueiKILT-EM0—Unverified
#ModelMetricClaimedVerifiedStatus
1SpanBERTF184.8—Unverified
2Cluster-Former (#C=512)EM68—Unverified
3Locality-Sensitive HashingEM66—Unverified
4Multi-passage BERTEM65.1—Unverified
5Sparse AttentionEM64.7—Unverified
6DECAPROPEM62.2—Unverified
7Bi-Attention + DCU-LSTMN-gram F159.5—Unverified
8Denoising QAEM58.8—Unverified
9DecaPropEM56.8—Unverified
10AMANDAN-gram F156.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Fourier TransformerRouge-L26.9—Unverified
2QGRouge-L26.4—Unverified
3BARTRouge-L24.3—Unverified
4E-MCARouge-L24—Unverified
5Transformer Multitask + LayerDropRouge-L23.4—Unverified
6Multi-InrerleaveRouge-L14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1Evidence Aggregation via R^3 Re-RankingEM (Quasar-T)42.3—Unverified
2Denoising QAEM (Quasar-T)42.2—Unverified
3DecaPropEM (Quasar-T)38.6—Unverified
4R^3EM (Quasar-T)35.3—Unverified
5GAEM (Quasar-T)26.4—Unverified
6BiDAFEM (Quasar-T)25.9—Unverified
#ModelMetricClaimedVerifiedStatus
1FiEExact Match58.4—Unverified
2R2-D2 HN-DPRExact Match55.9—Unverified
3UniK-QAExact Match54.9—Unverified
4UnitedQA (Hybrid)Exact Match54.7—Unverified
5BPR (linear scan; l=1000)Exact Match41.6—Unverified
#ModelMetricClaimedVerifiedStatus
1SPARTAEM59.3—Unverified
2Blended RAGEM57.63—Unverified
3BERTseriniEM50.2—Unverified
4BERTseriniEM38.6—Unverified
#ModelMetricClaimedVerifiedStatus
1UniK-QAExact Match57.7—Unverified
2FiE+PAQExact Match56.3—Unverified
3FiEExact Match52.4—Unverified
4EMDR2Exact Match48.7—Unverified
#ModelMetricClaimedVerifiedStatus
1DrQAEM70—Unverified
2DCNEM66.2—Unverified
3MPCMEM65.5—Unverified
#ModelMetricClaimedVerifiedStatus
1ERNIE 2.0 LargeEM64.2—Unverified
2ERNIE 2.0 BaseEM61.3—Unverified
#ModelMetricClaimedVerifiedStatus
1UniK-QAExact Match65.5—Unverified
2BPR (linear scan; l=1000)Exact Match56.8—Unverified
#ModelMetricClaimedVerifiedStatus
1EMDR2Exact Match52.5—Unverified
#ModelMetricClaimedVerifiedStatus
1UnitedQA (Hybrid)Exact Match70.5—Unverified