Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
12.6
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 61 | GPT-5.2 gpt-5.2-2025-12-11 multimodalvisionmulti-input reasoning | OpenAI | 31.5 Value / Price | 70.9 | 62.8 | 37.0 | 66.3 | 31.5 | $1.75 in / $14 out |
| 62 | GPT-5.3 Chat gpt-5.3-chat-latest multimodalvisionmulti-input reasoning | OpenAI | 31.5 Value / Price | 0.0 | 50.2 | 0.0 | 0.0 | 31.5 | |
| 63 | GPT-4o gpt-4o-2024-08-06 multimodalvisionmulti-input reasoning | OpenAI | 31.2 Value / Price | 29.1 | 39.6 | 14.9 | 3.7 | 31.2 | |
| 64 | GPT-4o gpt-4o-2024-05-13 multimodalvisionmulti-input reasoning | OpenAI | 30.7 Value / Price | 20.5 | 38.0 | 0.0 | 0.0 | 30.7 | |
| 65 | Gemini 2.5 Pro gemini-2.5-pro multimodalvisionmulti-input reasoning | Google | 29.8 Value / Price | 42.5 | 51.0 | 0.0 | 21.4 | 29.8 | |
| 66 | Grok-3 grok-3 multimodalvisionmulti-input reasoning | xAI | 24.1 Value / Price | 58.4 | 50.2 | 0.0 | 0.0 | 24.1 | $3 in / $15 out |
| 67 | Gemini 3.1 Pro gemini-3.1-pro-preview multimodalvisionmulti-input reasoning | Google | 22.7 Value / Price | 72.3 | 58.3 | 52.6 | 60.9 | 22.7 | |
| 68 | GPT-5.2 Codex gpt-5.2-codex multimodalvisionmulti-input reasoning | OpenAI | 22.0 Value / Price | 0.0 | 31.1 | 0.0 | 30.9 | 22.0 | |
| 69 | GPT-5.3 Codex gpt-5.3-codex texttext-to-textcoding | OpenAI | 22.0 Value / Price | 0.0 | 31.1 | 0.0 | 34.5 | 22.0 | |
| 70 | GPT-5.4 gpt-5.4 texttext-to-textlanguage | OpenAI | 18.5 Value / Price | 70.5 | 37.2 | 48.9 | 50.3 | 18.5 | |
| 71 | GPT-5.5 Instant gpt-5.5-instant multimodalvisionmulti-input reasoning | OpenAI | 17.3 Value / Price | 49.5 | 62.8 | 0.0 | 0.0 | 17.3 | |
| 72 | GPT-5.6 Terra gpt-5.6-terra multimodalvisionmulti-input reasoning | OpenAI | 17.1 Value / Price | 74.6 | 94.5 | 61.5 | 69.6 | 17.1 | |
| 73 | GPT-4 Turbo gpt-4-turbo-2024-04-09 textinference | OpenAI | 15.4 Value / Price | 15.5 | 50.2 | 0.0 | 0.0 | 15.4 | $10 in / $30 out |
| 74 | Kimi K3 kimi-k3 multimodalvisionmulti-input reasoning | Moonshot AI | 12.2 Value / Price | 76.1 | 84.8 | 84.2 | 0.0 | 12.2 | $3 in / $15 out |
| 75 | Claude Sonnet 4.5 claude-sonnet-4-5-20250929 multimodalvisionmulti-input reasoning | Anthropic | 12.0 Value / Price | 51.4 | 12.6 | 69.9 | 74.6 | 12.0 | |
| 76 | Claude Sonnet 4.6 claude-sonnet-4-6 multimodalvisionmulti-input reasoning | Anthropic | 12.0 Value / Price | 62.3 | 12.6 | 41.0 | 65.6 | 12.0 | |
| 77 | Claude Sonnet 5 claude-sonnet-5 multimodalvisionmulti-input reasoning | Anthropic | 12.0 Value / Price | 67.5 | 28.3 | 60.7 | 75.4 | 12.0 | |
| 78 | Claude Opus 4.6 claude-opus-4-6 multimodalvisionmulti-input reasoning | Anthropic | 8.0 Value / Price | 74.6 | 28.3 | 49.8 | 71.5 | 8.0 | |
| 79 | Claude Opus 4.7 claude-opus-4-7 multimodalvisionmulti-input reasoning | Anthropic | 8.0 Value / Price | 75.1 | 28.3 | 54.2 | 77.9 | 8.0 | |
| 80 | Claude Opus 4.8 claude-opus-4-8 multimodalvisionmulti-input reasoning | Anthropic | 8.0 Value / Price | 74.4 | 28.3 | 74.5 | 81.3 | 8.0 |
GPT-5.2
OpenAI
31.5
$1.75 in / $14 out
GPT-5.3 Chat
OpenAI
31.5
$1.75 in / $14 out
GPT-4o
OpenAI
31.2
$2.5 in / $10 out
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| $1.75 in / $14 out |
| $2.5 in / $10 out |
| $2.5 in / $10 out |
| $1.25 in / $10 out |
| $2.5 in / $15 out |
| $1.75 in / $14 out |
| $1.75 in / $14 out |
| $2.5 in / $15 out |
| $5 in / $30 out |
| $2.5 in / $15 out |
| $3 in / $15 out |
| $3 in / $15 out |
| $3 in / $15 out |
| $5 in / $25 out |
| $5 in / $25 out |
| $5 in / $25 out |
GPT-4o
OpenAI
30.7
$2.5 in / $10 out
Gemini 2.5 Pro
29.8
$1.25 in / $10 out
Grok-3
xAI
24.1
$3 in / $15 out
Gemini 3.1 Pro
22.7
$2.5 in / $15 out
GPT-5.2 Codex
OpenAI
22.0
$1.75 in / $14 out
GPT-5.5 Instant
OpenAI
17.3
$5 in / $30 out
GPT-5.6 Terra
OpenAI
17.1
$2.5 in / $15 out
GPT-4 Turbo
OpenAI
15.4
$10 in / $30 out
Kimi K3
Moonshot AI
12.2
$3 in / $15 out
Claude Sonnet 4.5
Anthropic
12.0
$3 in / $15 out
Claude Sonnet 4.6
Anthropic
12.0
$3 in / $15 out
Claude Sonnet 5
Anthropic
12.0
$3 in / $15 out
Claude Opus 4.6
Anthropic
8.0
$5 in / $25 out
Claude Opus 4.7
Anthropic
8.0
$5 in / $25 out
Claude Opus 4.8
Anthropic
8.0
$5 in / $25 out