Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
12.2
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 201 | GPT-5 nano gpt-5-nano-2025-08-07 multimodalvisionmulti-input reasoning | OpenAI | 0.0 Agentic | 25.2 | 0.0 | 0.0 | 13.3 | 0.0 | N/A |
| 202 | GPT OSS 120B High gpt-oss-120b-high multimodalvisionmulti-input reasoning | OpenAI | 0.0 Agentic | 44.1 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 203 | GPT OSS 20B High gpt-oss-20b-high textinference | OpenAI | 0.0 Agentic | 52.3 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 204 | Granite 3.3 8B Base granite-3.3-8b-base multimodalvisionmulti-input reasoning | IBM | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 205 | Granite 3.3 8B Instruct granite-3.3-8b-instruct multimodalvisionmulti-input reasoning | IBM | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 206 | IBM Granite 4.0 Tiny Preview granite-4.0-tiny-preview textinference | IBM | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 207 | Grok-1.5 grok-1.5 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 8.2 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 208 | Grok-1.5V grok-1.5v multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 9.7 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 209 | Grok-2 grok-2 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 25.7 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 210 | Grok-2 Image 1212 grok-2-image-1212 textinference | xAI | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 211 | Grok-2 mini grok-2-mini multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 22.8 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 212 | Grok-3 grok-3 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 58.4 | 50.2 | 0.0 | 0.0 | 24.1 | $3 in / $15 out |
| 213 | Grok-3 Mini grok-3-mini multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 51.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 214 | Grok-4 grok-4 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 49.1 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 215 | Grok-4.1 grok-4.1-2025-11-17 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 216 | Grok-4.1 Fast Non-Reasoning grok-4-1-fast-non-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 63.0 | 0.0 | 0.0 | 77.3 | |
| 217 | Grok-4.1 Fast Reasoning grok-4-1-fast-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 63.0 | 0.0 | 0.0 | 77.3 | |
| 218 | Grok-4.1 Thinking grok-4.1-thinking-2025-11-17 multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 219 | Grok-4.20 Beta Non-Reasoning grok-4.20-beta-0309-non-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | |
| 220 | Grok-4.20 Beta Reasoning grok-4.20-beta-0309-reasoning multimodalvisionmulti-input reasoning | xAI | 0.0 Agentic | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 |
GPT-5 nano
OpenAI
0.0
N/A
GPT OSS 120B High
OpenAI
0.0
N/A
GPT OSS 20B High
OpenAI
0.0
N/A
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| N/A |
| $0.2 in / $0.5 out |
| $0.2 in / $0.5 out |
| N/A |
| N/A |
| N/A |
Granite 3.3 8B Base
IBM
0.0
N/A
Granite 3.3 8B Instruct
IBM
0.0
N/A
IBM Granite 4.0 Tiny Preview
IBM
0.0
N/A
Grok-1.5
xAI
0.0
N/A
Grok-1.5V
xAI
0.0
N/A
Grok-2
xAI
0.0
N/A
Grok-2 Image 1212
xAI
0.0
N/A
Grok-2 mini
xAI
0.0
N/A
Grok-3
xAI
0.0
$3 in / $15 out
Grok-3 Mini
xAI
0.0
N/A
Grok-4
xAI
0.0
N/A
Grok-4.1
xAI
0.0
N/A
Grok-4.1 Fast Non-Reasoning
xAI
0.0
$0.2 in / $0.5 out
Grok-4.1 Fast Reasoning
xAI
0.0
$0.2 in / $0.5 out
Grok-4.1 Thinking
xAI
0.0
N/A
Grok-4.20 Beta Non-Reasoning
xAI
0.0
N/A
Grok-4.20 Beta Reasoning
xAI
0.0
N/A