SOTAVerified

Benchmarking

Papers

Showing 51115120 of 5548 papers

TitleStatusHype
User-Guided Deep Anime Line Art Colorization with Conditional Adversarial NetworksCode0
Towards a Benchmark for Large Language Models for Business Process Management TasksCode0
Weighting-Based Treatment Effect Estimation via Distribution LearningCode0
Slot Filling for Extracting Reskilling and Upskilling Options from the WebCode0
On Pitfalls of RemOve-And-Retrain: Data Processing Inequality PerspectiveCode0
Distributional Depth-Based Estimation of Object Articulation ModelsCode0
Benchmarking Linguistic Diversity of Large Language ModelsCode0
On Recurrent Neural Networks for Sequence-based Processing in CommunicationsCode0
Benchmarking Learning Efficiency in Deep Reservoir ComputingCode0
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive EvaluationCode0
Show:102550
← PrevPage 512 of 555Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GPT-4 TurboACC0.56Unverified