HMMT25
Progress Over Time
Interactive timeline showing model performance evolution on HMMT25
HMMT25 Leaderboard
| Context | Cost | License | ||||
|---|---|---|---|---|---|---|
| 1 | xAI | — | — | — | ||
| 2 | Alibaba Cloud / Qwen Team | — | 1.0M | $0.50 / $3.00 | ||
| 3 | Alibaba Cloud / Qwen Team | 397B | — | — | ||
| 4 | Alibaba Cloud / Qwen Team | 28B | 262K | $0.60 / $3.60 | ||
| 5 | Alibaba Cloud / Qwen Team | 122B | — | — | ||
| 6 | xAI | — | — | — | ||
| 7 | Alibaba Cloud / Qwen Team | 27B | 262K | $0.30 / $2.40 | ||
| 8 | Alibaba Cloud / Qwen Team | 35B | — | — | ||
| 9 | Alibaba Cloud / Qwen Team | 35B | — | — | ||
| 10 | Sarvam AI | 105B | — | — | ||
| 11 | Alibaba Cloud / Qwen Team | 235B | — | — | ||
| 12 | Alibaba Cloud / Qwen Team | 9B | — | — | ||
| 13 | Alibaba Cloud / Qwen Team | 236B | — | — | ||
| 14 | Alibaba Cloud / Qwen Team | 4B | — | — | ||
| 15 | Sarvam AI | 30B | — | — | ||
| 16 | Alibaba Cloud / Qwen Team | 80B | — | — | ||
| 17 | Alibaba Cloud / Qwen Team | 31B | — | — | ||
| 18 | Alibaba Cloud / Qwen Team | 9B | — | — | ||
| 19 | Alibaba Cloud / Qwen Team | 236B | — | — | ||
| 20 | Alibaba Cloud / Qwen Team | 235B | — | — | ||
| 21 | Alibaba Cloud / Qwen Team | 80B | — | — | ||
| 22 | Alibaba Cloud / Qwen Team | 4B | 262K | $0.10 / $1.00 | ||
| 23 | Alibaba Cloud / Qwen Team | 31B | — | — | ||
| 24 | Alibaba Cloud / Qwen Team | 9B | — | — | ||
| 25 | Alibaba Cloud / Qwen Team | 4B | 262K | $0.10 / $0.60 |
What is HMMT25?
Harvard-MIT Mathematics Tournament 2025 - A prestigious student-organized mathematics competition for high school students featuring two tournaments (November 2025 at MIT and February 2026 at Harvard) with individual tests, team rounds, and guts rounds
HMMT25 is a text benchmark evaluating models on math tasks. LLM Stats tracks 25 models on this benchmark, scored on a 0–1 scale. The current average is 0.7, with the leader at 1.0.
Compare leaders on the best AI for math leaderboards.
Current leaders
Grok-4 Heavy from xAI currently leads the HMMT25 leaderboard with a score of 0.967 across 25 evaluated AI models.
FAQ
Common questions about the HMMT25 benchmark and leaderboard.