SOTAVerified

Code Completion

Papers

Showing 26–50 of 212 papers

TitleStatusHype
LongSpec: Long-Context Speculative Decoding with Efficient Drafting and VerificationCode2
Comparative Analysis of Large Language Models for Context-Aware Code Completion using SAFIM Framework—0
Mechanistic Understanding of Language Models in Syntactic Code Completion—0
How to Get Your LLM to Generate Challenging Problems for EvaluationCode1
MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task—0
GREEN-CODE: Learning to Optimize Energy Efficiency in LLM-based Code GenerationCode0
Improving FIM Code Completions via Context & Curriculum Based Learning—0
ExecRepoBench: Multi-level Executable Code Completion Evaluation—0
ContextModule: Improving Code Completion via Repository-level Contextual Information—0
Protect Your Secrets: Understanding and Measuring Data Exposure in VSCode Extensions—0
LibEvolutionEval: A Benchmark and Study for Version-Specific Code Generation—0
FastDraft: How to Train Your Draft—0
CoCoP: Enhancing Text Classification with LLM through Code Completion Prompt—0
GitChameleon: Unmasking the Version-Switching Capabilities of Code Generation ModelsCode1
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking—0
Can Language Models Replace Programmers for Coding? REPOCOD Says 'Not Yet'Code1
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation—0
Building A Coding Assistant via the Retrieval-Augmented Language ModelCode1
Contextual Augmented Multi-Model Programming (CAMP): A Hybrid Local-Cloud Copilot FrameworkCode9
aiXcoder-7B: A Lightweight and Effective Large Language Model for Code ProcessingCode7
KV Prediction for Improved Time to First Token—0
CursorCore: Assist Programming through Aligning AnythingCode2
CodeCipher: Learning to Obfuscate Source Code Against LLMs—0
Horizon-Length Prediction: Advancing Fill-in-the-Middle Capabilities for Code Generation with Lookahead Planning—0
Codev-Bench: How Do LLMs Understand Developer-Centric Code Completion?Code2
Show:102550
← PrevPage 2 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1deepseek-coder-33b-baseAverage69.01—Unverified
2deepseek-coder-6.7b-baseAverage63.4—Unverified
3starcoderbaseAverage55.54—Unverified
4gpt-4-1106-previewAverage53.28—Unverified
5CodeLlama-13b-hfAverage52.78—Unverified
6deepseek-coder-1.3b-baseAverage52.63—Unverified
7CodeLlama-34b-hfAverage49.66—Unverified
8CodeLlama-7b-hfAverage45—Unverified
9gpt-3.5-turbo-0301Average40.86—Unverified
10incoder-6BAverage33.79—Unverified
#ModelMetricClaimedVerifiedStatus
1CodeGPT-adaptedAccuracy (token-level)77.13—Unverified
2CodeT5+ 770MEM (line-level)37.9—Unverified
3CodeT5+ 220MEM (line-level)35.17—Unverified
#ModelMetricClaimedVerifiedStatus
1CodeGPT-adaptedAccuracy (token-level)75.11—Unverified
2CodeT5+ 770MEM (line-level)44.86—Unverified
3CodeT5+ 220MEM (line-level)43.42—Unverified
#ModelMetricClaimedVerifiedStatus
1SantaCoder-MGDCompilation Rate73.03—Unverified
2SantaCoderCompilation Rate59.97—Unverified
3SantaCoderCompilation Rate59.79—Unverified
#ModelMetricClaimedVerifiedStatus
1RamboCompilation Rate76.47—Unverified
2RepoCoderCompilation Rate74.02—Unverified
#ModelMetricClaimedVerifiedStatus
1RamboCompilation Rate61.7—Unverified
2RepoCoderCompilation Rate58.09—Unverified