SOTAVerified

MMLU

Papers

Showing 11–20 of 340 papers

TitleStatusHype
Training Compute-Optimal Large Language ModelsCode6
Make Your LLM Fully Utilize the ContextCode5
BioMedLM: A 2.7B Parameter Language Model Trained On Biomedical TextCode4
Baichuan 2: Open Large-scale Language ModelsCode4
Galactica: A Large Language Model for ScienceCode4
Improving Retrieval-Augmented Generation in Medicine with Iterative Follow-up QuestionsCode4
ChatMusician: Understanding and Generating Music Intrinsically with LLMCode3
LoLCATs: On Low-Rank Linearizing of Large Language ModelsCode3
LayerSkip: Enabling Early Exit Inference and Self-Speculative DecodingCode3
DataDecide: How to Predict Best Pretraining Data with Small ExperimentsCode3
Show:102550
← PrevPage 2 of 34Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1go ahead, make my dataFinal_score61.72—Unverified
2#GreedyCowFinal_score61.63—Unverified
3Don't Ask Us yFinal_score61.4—Unverified
4Data_and_ConfusedFinal_score60.96—Unverified
5WafflesFinal_score60.91—Unverified
6raakaFinal_score60.91—Unverified
7Team ProcrustinationFinal_score60.64—Unverified
8Axiom Consulting PartnersFinal_score60.63—Unverified
9Lets_Be_FairFinal_score60.23—Unverified
10goonersFinal_score60.22—Unverified
#ModelMetricClaimedVerifiedStatus
1Orange-mini0-shot MRR99.19—Unverified
#ModelMetricClaimedVerifiedStatus
1HybridBeam+SI-SDRi13.3—Unverified