RefCOCO-avg
Progress Over Time
Interactive timeline showing model performance evolution on RefCOCO-avg
RefCOCO-avg Leaderboard
| Context | Cost | License | ||||
|---|---|---|---|---|---|---|
| 1 | Alibaba Cloud / Qwen Team | — | 1.0M | $0.50 / $3.00 | ||
| 2 | Alibaba Cloud / Qwen Team | 28B | 262K | $0.60 / $3.60 | ||
| 3 | Alibaba Cloud / Qwen Team | 236B | — | — | ||
| 4 | Alibaba Cloud / Qwen Team | 35B | — | — | ||
| 5 | Alibaba Cloud / Qwen Team | 122B | — | — | ||
| 6 | Alibaba Cloud / Qwen Team | 27B | 262K | $0.30 / $2.40 | ||
| 7 | Alibaba Cloud / Qwen Team | 35B | — | — | ||
| 8 | Liquid AI | 3B | — | — | ||
| 9 | 2B | — | — |
What is RefCOCO-avg?
RefCOCO-avg measures object grounding accuracy averaged across RefCOCO, RefCOCO+, and RefCOCOg benchmarks.
RefCOCO-avg is a image benchmark evaluating models on spatial reasoning, grounding, and vision tasks. LLM Stats tracks 9 models on this benchmark, scored on a 0–100 scale. The current average is 0.9, with the leader at 0.9.
Compare leaders on the best AI for spatial reasoning, best AI for grounding and best AI for vision leaderboards.
Current leaders
Qwen3.6 Plus from Alibaba Cloud / Qwen Team currently leads the RefCOCO-avg leaderboard with a score of 0.935 across 9 evaluated AI models.
FAQ
Common questions about the RefCOCO-avg benchmark and leaderboard.