SOTAVerified

Program Repair

Task of teaching ML models to modify an existing program to fix a bug in a given code.

Papers

Showing 51–75 of 132 papers

TitleStatusHype
Arachne: Search Based Repair of Deep Neural NetworksCode0
Teaching Large Language Models to Self-DebugCode0
Synthetic Code Surgery: Repairing Bugs and Vulnerabilities with LLMs and Synthetic Data—0
Exploring the Potential of Conversational Test Suite Based Program Repair on SWE-bench—0
Fairness-guided SMT-based Rectification of Decision Trees and Random Forests—0
Collu-Bench: A Benchmark for Predicting Language Model Hallucinations in Code—0
Frustrated with Code Quality Issues? LLMs can Help!—0
Fully Autonomous Programming with Large Language Models—0
Generating Bug-Fixes Using Pretrained Transformers—0
BigIssue: A Realistic Bug Localization Benchmark—0
Gradient-Based Program Repair: Fixing Bugs in Continuous Program Spaces—0
Grammar-Based Patches Generation for Automated Program Repair—0
Automatic Programming: Large Language Models and Beyond—0
GRAPHIX: A Pre-trained Graph Edit Model for Automated Program Repair—0
T^3: Multi-level Tree-based Automatic Program Repair with Large Language Models—0
Automated Program Repair: Emerging trends pose and expose problems for benchmarks—0
SpecRover: Code Intent Extraction via LLMs—0
Enhancing Automated Program Repair through Fine-tuning and Prompt Engineering—0
Improving Automated Program Repair with Domain Adaptation—0
In-Context Code-Text Learning for Bimodal Software Engineering—0
Automated C/C++ Program Repair for High-Level Synthesis via Large Language Models—0
Tea: Program Repair Using Neural Network Based on Program Information Attention Matrix—0
A Comprehensive Survey of AI-Driven Advancements and Techniques in Automated Program Repair and Code Generation—0
Is ChatGPT the Ultimate Programming Assistant -- How far is it?—0
Keep the Conversation Going: Fixing 162 out of 337 bugs for $0.42 each using ChatGPT—0
Show:102550
← PrevPage 3 of 6Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1DrRepair + BIFIAverage Success Rate71.7—Unverified
2DrRepairAverage Success Rate68.2—Unverified
3SampleFixAverage Success Rate45.3—Unverified
4RLAssistAverage Success Rate26.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer + BIFIAccuracy (%)90.5—Unverified
2TransformerAccuracy (%)62—Unverified
#ModelMetricClaimedVerifiedStatus
1MGDebugger (DeepSeek-Coder-V2-Lite)Pass@197.6—Unverified
#ModelMetricClaimedVerifiedStatus
1TFixError Removal678—Unverified