SOTAVerified

Automated Essay Scoring

Essay scoring: Automated Essay Scoring is the task of assigning a score to an essay, usually in the context of assessing the language ability of a language learner. The quality of an essay is affected by the following four primary dimensions: topic relevance, organization and coherence, word usage and sentence complexity, and grammar and mechanics.

Source: A Joint Model for Multimodal Document Quality Assessment

Papers

Showing 26–50 of 104 papers

TitleStatusHype
Automated Essay Scoring Incorporating Annotations from Automated Feedback Systems—0
Automated Essay Scoring with Discourse-Aware Neural Models—0
Automated essay scoring in Arabic: a dataset and analysis of a BERT-based system—0
Can ChatGPT and Bard Generate Aligned Assessment Items? A Reliability Analysis against Human Performance—0
Can GPT-4 do L2 analytic assessment?—0
ARWI: Arabic Write and Improve—0
Corruption Is Not All Bad: Incorporating Discourse Structure into Pre-training via Corruption for Essay Scoring—0
Constrained Multi-Task Learning for Automated Essay Scoring—0
Computing with Subjectivity Lexicons—0
Data Augmentation for Automated Essay Scoring using Transformer Models—0
Automated Essay Scoring for Swedish—0
Composable Cross-prompt Essay Scoring by Merging Models—0
Are Large Language Models Good Essay Graders?—0
Does the Prompt-based Large Language Model Recognize Students' Demographics and Introduce Bias in Essay Scoring?—0
Do We Need a Detailed Rubric for Automated Essay Scoring using Large Language Models?—0
DREsS: Dataset for Rubric-based Essay Scoring on EFL Writing—0
Empirical Study of Large Language Models as Automated Essay Scoring Tools in English Composition__Taking TOEFL Independent Writing Task for Example—0
Encoder Decoder Approach to Automated Essay Scoring For Deeper Semantic Analysis—0
Enhancing Arabic Automated Essay Scoring with Synthetic Data and Error Injection—0
Enhancing Automated Essay Scoring Performance via Fine-tuning Pre-trained Language Models with Combination of Regression and Ranking—0
Enhancing Essay Scoring with Adversarial Weights Perturbation and Metric-specific AttentionPooling—0
Centering-based Neural Coherence Modeling with Hierarchical Discourse Segments—0
Automated Essay Scoring Using Grammatical Variety and Errors with Multi-Task Learning and Item Response Theory—0
EssayJudge: A Multi-Granular Benchmark for Assessing Automated Essay Scoring Capabilities of Multimodal Large Language Models—0
Automated Essay Scoring by Maximizing Human-Machine Agreement—0
Show:102550
← PrevPage 2 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Neural Pairwise Contrastive Regression (NPCR)Quadratic Weighted Kappa0.82—Unverified
2Tran-BERT-MS-ML-RQuadratic Weighted Kappa0.79—Unverified
3Considering-Content-XLNetQuadratic Weighted Kappa0.79—Unverified
4HISK+BOSWEQuadratic Weighted Kappa0.79—Unverified
5SkipFlowQuadratic Weighted Kappa0.76—Unverified
6MHMLWQuadratic Weighted Kappa0.76—Unverified
7AFQuadratic Weighted Kappa0.73—Unverified
8FDAQuadratic Weighted Kappa0.71—Unverified