Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
28.3
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 301 | Grok-4.20 Beta Non-Reasoning grok-4.20-beta-0309-non-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 302 | Grok-4.20 Beta Reasoning grok-4.20-beta-0309-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 303 | Grok-4.20 Multi-Agent Beta grok-4.20-multi-agent-beta-0309 multimodalvisionmulti-input reasoning | xAI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 304 | Grok 4.3 grok-4.3 textinference | xAI | 0.0 Benchmarks | 0.0 | 62.8 | 0.0 | 0.0 | 52.4 | $1.25 in / $2.5 out |
| 305 | Grok-4 Fast Non-Reasoning grok-4-fast-non-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 306 | Grok-4 Fast Reasoning grok-4-fast-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Benchmarks | 0.0 | 63.0 | 0.0 | 0.0 | 77.3 | |
| 307 | Grok Code Fast 1 grok-code-fast-1 codeprogrammingtool use | xAI | 0.0 Benchmarks | 0.0 | 27.2 | 0.0 | 36.1 | 60.5 | $0.2 in / $1.5 out |
| 308 | Kimi K2.7 Code kimi-k2.7-code multimodalvisionmulti-input reasoning | Moonshot AI | 0.0 Benchmarks | 0.0 | 32.9 | 47.2 | 0.0 | 47.6 | |
| 309 | Llama 3.1 Nemotron 70B Instruct llama-3.1-nemotron-70b-instruct textinference | NVIDIA | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 310 | MedGemma 4B IT medgemma-4b-it multimodalvisionmulti-input reasoning | Google | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 311 | MiMo-V2-Omni mimo-v2-omni multimodalvisionmulti-input reasoning | Xiaomi | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 50.9 | 0.0 | N/A |
| 312 | MiMo-V2-Pro mimo-v2-pro codeprogrammingtool use | Xiaomi | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 61.9 | 0.0 | N/A |
| 313 | MiniMax M2.5 minimax-m2.5 codeprogrammingtool use | MiniMax | 0.0 Benchmarks | 0.0 | 68.9 | 43.6 | 50.4 | 72.9 | $0.3 in / $1.2 out |
| 314 | MiniMax M2.7 minimax-m2.7 codeprogrammingtool use | MiniMax | 0.0 Benchmarks | 0.0 | 19.5 | 26.3 | 29.0 | 73.2 | $0.3 in / $1.2 out |
| 315 | Ministral 3 (14B Base 2512) ministral-3-14b-base-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 316 | MiniStral 3 (14B Instruct 2512) ministral-3-14b-instruct-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 317 | Ministral 3 (3B Base 2512) ministral-3-3b-base-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 318 | Ministral 3 (3B Instruct 2512) ministral-3-3b-instruct-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 319 | Ministral 3 (8B Base 2512) ministral-3-8b-base-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 320 | Ministral 3 (8B Instruct 2512) ministral-3-8b-instruct-2512 multimodalvisionmulti-input reasoning | Mistral AI | 0.0 Benchmarks | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 |
Grok-4.20 Beta Non-Reasoning
xAI
0.0
N/A
Grok-4.20 Beta Reasoning
xAI
0.0
N/A
Grok-4.20 Multi-Agent Beta
xAI
0.0
N/A
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| N/A |
| N/A |
| N/A |
| $0.2 in / $0.5 out |
| $0.74 in / $3.5 out |
| N/A |
| N/A |
| N/A |
| N/A |
| N/A |
| N/A |
| N/A |
Grok 4.3
xAI
0.0
$1.25 in / $2.5 out
Grok-4 Fast Non-Reasoning
xAI
0.0
N/A
Grok-4 Fast Reasoning
xAI
0.0
$0.2 in / $0.5 out
Grok Code Fast 1
xAI
0.0
$0.2 in / $1.5 out
Kimi K2.7 Code
Moonshot AI
0.0
$0.74 in / $3.5 out
Llama 3.1 Nemotron 70B Instruct
NVIDIA
0.0
N/A
MedGemma 4B IT
0.0
N/A
MiMo-V2-Omni
Xiaomi
0.0
N/A
MiMo-V2-Pro
Xiaomi
0.0
N/A
MiniMax M2.5
MiniMax
0.0
$0.3 in / $1.2 out
MiniMax M2.7
MiniMax
0.0
$0.3 in / $1.2 out
Ministral 3 (14B Base 2512)
Mistral AI
0.0
N/A
MiniStral 3 (14B Instruct 2512)
Mistral AI
0.0
N/A
Ministral 3 (3B Base 2512)
Mistral AI
0.0
N/A
Ministral 3 (3B Instruct 2512)
Mistral AI
0.0
N/A
Ministral 3 (8B Base 2512)
Mistral AI
0.0
N/A
Ministral 3 (8B Instruct 2512)
Mistral AI
0.0
N/A