ModelRefs / RepoBench Leaderboard — AI Model Scores

RepoBench Leaderboard — AI Model Scores

Repository-level code completion across long context. Current leaders, methodology, and citation sources for RepoBench.

Overview

Repository-level code completion across long context.

How it is measured: Exact-match / edit-similarity across retrieval + completion.

How this benchmark is scored

Categorycoding
Maximum score100 % EM
DirectionHigher is better

Primary source: https://arxiv.org/abs/2306.03091

Continue your research

Use these connected ModelRefs sections to compare alternatives, inspect implementation paths, and review the evidence and governance boundaries relevant to RepoBench Leaderboard — AI Model Scores.