SWE Atlas - Codebase QnA
Progress Over Time
Interactive timeline showing model performance evolution on SWE Atlas - Codebase QnA
SWE Atlas - Codebase QnA Leaderboard
| Context | Cost | License | ||||
|---|---|---|---|---|---|---|
| 1 | MiniMax | — | 1.0M | $0.30 / $1.20 |
What is SWE Atlas - Codebase QnA?
SWE Atlas - Codebase QnA evaluates a model's ability to answer questions about real codebases, measuring repository-level comprehension and the ability to reason about code structure, behavior, and intent across an entire project.
SWE Atlas - Codebase QnA is a text benchmark evaluating models on agents and code tasks. LLM Stats tracks 1 models on this benchmark, scored on a 0–1 scale. The current average is 0.4, with the leader at 0.4.
Compare leaders on the best AI for agents and best AI for code leaderboards.
Current leaders
MiniMax M3 from MiniMax currently leads the SWE Atlas - Codebase QnA leaderboard with a score of 0.379 across 1 evaluated AI models.
FAQ
Common questions about the SWE Atlas - Codebase QnA benchmark and leaderboard.