SOTAVerified

Code Completion

Papers

Showing 101–125 of 212 papers

TitleStatusHype
Chain of Agents: Large Language Models Collaborating on Long-Context Tasks—0
CoCoP: Enhancing Text Classification with LLM through Code Completion Prompt—0
CodeCipher: Learning to Obfuscate Source Code Against LLMs—0
Code Completion by Modeling Flattened Abstract Syntax Trees as Graphs—0
Code Completion using Neural Attention and Byte Pair Encoding—0
CodeGemma: Open Code Models Based on Gemma—0
CodeMixBench: Evaluating Large Language Models on Code Generation with Code-Mixed Prompts—0
Coeditor: Leveraging Contextual Changes for Multi-round Code Auto-editing—0
Comparative Analysis of Large Language Models for Context-Aware Code Completion using SAFIM Framework—0
Compilable Neural Code Generation with Compiler Feedback—0
Context Composing for Full Line Code Completion—0
ContextModule: Improving Code Completion via Repository-level Contextual Information—0
Critique Ability of Large Language Models—0
Curriculum Learning for Small Code Language Models—0
DeepVS: An Efficient and Generic Approach for Source Code Modeling Usage—0
Does Your Neural Code Completion Model Use My Code? A Membership Inference Approach—0
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates—0
Dynamic Neural Program Embeddings for Program Repair—0
EduBot -- Can LLMs Solve Personalized Learning and Programming Assignments?—0
Enhancing LLM-Based Coding Tools through Native Integration of IDE-Derived Static Context—0
Evaluating Long Range Dependency Handling in Code Generation Models using Multi-Step Key Retrieval—0
ExecRepoBench: Multi-level Executable Code Completion Evaluation—0
Exploring ChatGPT's Ability to Rank Content: A Preliminary Study on Consistency with Human Preferences—0
Fast and Memory-Efficient Neural Code Completion—0
FastDraft: How to Train Your Draft—0
Show:102550
← PrevPage 5 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1deepseek-coder-33b-baseAverage69.01—Unverified
2deepseek-coder-6.7b-baseAverage63.4—Unverified
3starcoderbaseAverage55.54—Unverified
4gpt-4-1106-previewAverage53.28—Unverified
5CodeLlama-13b-hfAverage52.78—Unverified
6deepseek-coder-1.3b-baseAverage52.63—Unverified
7CodeLlama-34b-hfAverage49.66—Unverified
8CodeLlama-7b-hfAverage45—Unverified
9gpt-3.5-turbo-0301Average40.86—Unverified
10incoder-6BAverage33.79—Unverified
#ModelMetricClaimedVerifiedStatus
1CodeGPT-adaptedAccuracy (token-level)77.13—Unverified
2CodeT5+ 770MEM (line-level)37.9—Unverified
3CodeT5+ 220MEM (line-level)35.17—Unverified
#ModelMetricClaimedVerifiedStatus
1CodeGPT-adaptedAccuracy (token-level)75.11—Unverified
2CodeT5+ 770MEM (line-level)44.86—Unverified
3CodeT5+ 220MEM (line-level)43.42—Unverified
#ModelMetricClaimedVerifiedStatus
1SantaCoder-MGDCompilation Rate73.03—Unverified
2SantaCoderCompilation Rate59.97—Unverified
3SantaCoderCompilation Rate59.79—Unverified
#ModelMetricClaimedVerifiedStatus
1RamboCompilation Rate76.47—Unverified
2RepoCoderCompilation Rate74.02—Unverified
#ModelMetricClaimedVerifiedStatus
1RamboCompilation Rate61.7—Unverified
2RepoCoderCompilation Rate58.09—Unverified