Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
12.6
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 41 | GLM-5.2 glm-5.2 codeprogrammingtool use | Zhipu AI | 51.2 Value / Price | 68.7 | 84.8 | 44.1 | 59.9 | 51.2 | $0.95 in / $3 out |
| 42 | Qwen3.6-27B qwen3.6-27b multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 49.4 Value / Price | 54.7 | 32.9 | 0.0 | 39.4 | 49.4 | $0.6 in / $3.6 out |
| 43 | Kimi K2.7 Code kimi-k2.7-code multimodalvisionmulti-input reasoning | Moonshot AI | 47.6 Value / Price | 0.0 | 32.9 | 47.2 | 0.0 | 47.6 | |
| 44 | Kimi K2.6 kimi-k2.6 texttext-to-textlanguage | Moonshot AI | 46.3 Value / Price | 63.5 | 32.9 | 47.2 | 69.4 | 46.3 | |
| 45 | Claude Haiku 4.5 claude-haiku-4-5-20251001 multimodalvisionmulti-input reasoning | Anthropic | 45.6 Value / Price | 30.8 | 53.3 | 50.8 | 53.9 | 45.6 | |
| 46 | DeepSeek-V4-Pro-Max deepseek-v4-pro-max codeprogrammingtool use | DeepSeek | 45.1 Value / Price | 64.9 | 84.8 | 51.0 | 52.0 | 45.1 | |
| 47 | Qwen3.7 Max qwen3.7-max multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 43.9 Value / Price | 64.7 | 62.8 | 49.6 | 74.2 | 43.9 | $1.25 in / $3.75 out |
| 48 | GPT-5.4 Mini gpt-5.4-mini texttext-to-textlanguage | OpenAI | 42.7 Value / Price | 51.1 | 44.5 | 15.0 | 20.0 | 42.7 | |
| 49 | Muse Spark 1.1 muse-spark-1.1 multimodalvisionmulti-input reasoning | Meta | 41.5 Value / Price | 69.7 | 84.8 | 76.6 | 58.1 | 41.5 | $1.25 in / $4.25 out |
| 50 | GPT-4.1 gpt-4.1-2025-04-14 multimodalvisionmulti-input reasoning | OpenAI | 40.7 Value / Price | 27.2 | 73.2 | 32.8 | 14.7 | 40.7 | |
| 51 | GLM-5.1 glm-5.1 codeprogrammingtool use | Zhipu AI | 40.2 Value / Price | 62.6 | 15.9 | 35.2 | 47.2 | 40.2 | $1.4 in / $4.4 out |
| 52 | GLM-5 glm-5 codeprogrammingtool use | Zhipu AI | 40.0 Value / Price | 0.0 | 6.9 | 35.1 | 60.4 | 40.0 | $1 in / $3.2 out |
| 53 | GPT-5.6 Luna gpt-5.6-luna multimodalvisionmulti-input reasoning | OpenAI | 37.8 Value / Price | 63.9 | 94.5 | 55.0 | 65.5 | 37.8 | |
| 54 | GPT-5.1 gpt-5.1-2025-11-13 multimodalvisionmulti-input reasoning | OpenAI | 37.3 Value / Price | 62.4 | 62.8 | 0.0 | 51.4 | 37.3 | |
| 55 | GPT-5.1 Instant gpt-5.1-instant-2025-11-12 multimodalvisionmulti-input reasoning | OpenAI | 37.3 Value / Price | 62.4 | 62.8 | 0.0 | 51.4 | 37.3 | |
| 56 | Grok 4.5 grok-4.5 multimodalvisionmulti-input reasoning | xAI | 35.6 Value / Price | 69.3 | 38.2 | 0.0 | 70.8 | 35.6 | $2 in / $6 out |
| 57 | Gemini 3.6 Flash gemini-3.6-flash multimodalvisionmulti-input reasoning | Google | 34.8 Value / Price | 57.8 | 84.8 | 0.0 | 52.6 | 34.8 | |
| 58 | Mistral Medium 3.5 mistral-medium-3-5 multimodalvisionmulti-input reasoning | Mistral AI | 34.8 Value / Price | 34.6 | 23.2 | 15.4 | 59.0 | 34.8 | |
| 59 | GPT-5.1 Medium gpt-5.1-medium-2025-11-12 multimodalvisionmulti-input reasoning | OpenAI | 32.0 Value / Price | 64.1 | 44.9 | 0.0 | 0.0 | 32.0 | |
| 60 | Gemini 3.5 Flash gemini-3.5-flash multimodalvisionmulti-input reasoning | Google | 31.7 Value / Price | 60.2 | 84.8 | 67.3 | 21.8 | 31.7 |
GLM-5.2
Zhipu AI
51.2
$0.95 in / $3 out
Qwen3.6-27B
Alibaba Cloud / Qwen Team
49.4
$0.6 in / $3.6 out
Kimi K2.7 Code
Moonshot AI
47.6
$0.74 in / $3.5 out
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| $0.74 in / $3.5 out |
| $0.75 in / $3.5 out |
| $1 in / $5 out |
| $1.6 in / $3.2 out |
| $0.75 in / $4.5 out |
| $2 in / $8 out |
| $1 in / $6 out |
| $1.25 in / $10 out |
| $1.25 in / $10 out |
| $1.5 in / $7.5 out |
| $1.5 in / $7.5 out |
| $1.25 in / $10 out |
| $1.5 in / $9 out |
Kimi K2.6
Moonshot AI
46.3
$0.75 in / $3.5 out
Claude Haiku 4.5
Anthropic
45.6
$1 in / $5 out
DeepSeek-V4-Pro-Max
DeepSeek
45.1
$1.6 in / $3.2 out
Qwen3.7 Max
Alibaba Cloud / Qwen Team
43.9
$1.25 in / $3.75 out
Muse Spark 1.1
Meta
41.5
$1.25 in / $4.25 out
GPT-4.1
OpenAI
40.7
$2 in / $8 out
GLM-5.1
Zhipu AI
40.2
$1.4 in / $4.4 out
GLM-5
Zhipu AI
40.0
$1 in / $3.2 out
GPT-5.6 Luna
OpenAI
37.8
$1 in / $6 out
GPT-5.1
OpenAI
37.3
$1.25 in / $10 out
GPT-5.1 Instant
OpenAI
37.3
$1.25 in / $10 out
Grok 4.5
xAI
35.6
$2 in / $6 out
Gemini 3.6 Flash
34.8
$1.5 in / $7.5 out
Mistral Medium 3.5
Mistral AI
34.8
$1.5 in / $7.5 out
GPT-5.1 Medium
OpenAI
32.0
$1.25 in / $10 out
Gemini 3.5 Flash
31.7
$1.5 in / $9 out