SOTAVerified

Sentence Completion

Papers

Showing 41–50 of 91 papers

TitleStatusHype
SC-Ques: A Sentence Completion Question Dataset for English as a Second Language LearnersCode0
Factuality Enhanced Language Models for Open-Ended Text GenerationCode5
Measuring Harmful Sentence Completion in Language Models for LGBTQIA+ IndividualsCode1
PaLM: Scaling Language Modeling with PathwaysCode2
Training Compute-Optimal Large Language ModelsCode6
Efficient Language Modeling with Sparse all-MLP—0
Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language ModelCode3
Scaling Language Models: Methods, Analysis & Insights from Training GopherCode2
SeqPATE: Differentially Private Text Generation via Knowledge Distillation—0
Language Models as a Knowledge Source for Cognitive Agents—0
Show:102550
← PrevPage 5 of 10Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1CompassMTL 567M with TailorAccuracy96.1—Unverified
2CompassMTL 567MAccuracy95.6—Unverified
3DeBERTa-Large 304M (classification-based)Accuracy95.6—Unverified
4GPT-4 (10-shot)Accuracy95.3—Unverified
5LLaMA3+MoSLoRAAccuracy95—Unverified
6LLaMA-2 13B + MixLoRAAccuracy94.7—Unverified
7DeBERTa-Large 304MAccuracy94.7—Unverified
8Unicorn 11B (fine-tuned)Accuracy93.9—Unverified
9LLaMA-3 8B + MixLoRAAccuracy93.3—Unverified
10LLaMA-2 7B + MixLoRAAccuracy93.1—Unverified