Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
12.6
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 21 | MiniMax M2 minimax-m2 codeprogrammingtool use | MiniMax | 73.2 Value / Price | 29.8 | 62.8 | 40.2 | 40.0 | 73.2 | $0.3 in / $1.2 out |
| 22 | MiniMax M2.7 minimax-m2.7 codeprogrammingtool use | MiniMax | 73.2 Value / Price | 0.0 | 19.5 | 26.3 | 29.0 | 73.2 | $0.3 in / $1.2 out |
| 23 | MiniMax M3 minimax-m3 multimodalvisionmulti-input reasoning | MiniMax | 73.2 Value / Price | 49.6 | 62.8 | 37.5 | 68.3 | 73.2 | $0.3 in / $1.2 out |
| 24 | MiniMax M2.1 minimax-m2.1 codeprogrammingtool use | MiniMax | 72.9 Value / Price | 39.1 | 68.9 | 45.7 | 47.6 | 72.9 | $0.3 in / $1.2 out |
| 25 | MiniMax M2.5 minimax-m2.5 codeprogrammingtool use | MiniMax | 72.9 Value / Price | 0.0 | 68.9 | 43.6 | 50.4 | 72.9 | $0.3 in / $1.2 out |
| 26 | GPT-4.1 mini gpt-4.1-mini-2025-04-14 multimodalvisionmulti-input reasoning | OpenAI | 69.5 Value / Price | 19.2 | 84.6 | 8.9 | 2.2 | 69.5 | |
| 27 | Qwen3.7-Plus qwen3.7-plus multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 69.5 Value / Price | 62.9 | 62.8 | 48.1 | 61.1 | 69.5 | $0.32 in / $1.28 out |
| 28 | GPT-5 mini gpt-5-mini-2025-08-07 multimodalvisionmulti-input reasoning | OpenAI | 68.5 Value / Price | 39.4 | 77.4 | 0.0 | 22.2 | 68.5 | |
| 29 | Gemini 3.1 Flash-Lite gemini-3.1-flash-lite-preview multimodalvisionmulti-input reasoning | Google | 67.1 Value / Price | 52.6 | 62.8 | 0.0 | 0.0 | 67.1 | |
| 30 | Qwen3.5-27B qwen3.5-27b multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 61.0 Value / Price | 57.8 | 32.9 | 41.3 | 39.1 | 61.0 | $0.3 in / $2.4 out |
| 31 | GPT-3.5 Turbo gpt-3.5-turbo-0125 multimodalvisionmulti-input reasoning | OpenAI | 60.7 Value / Price | 2.3 | 30.1 | 0.0 | 0.0 | 60.7 | |
| 32 | Grok Code Fast 1 grok-code-fast-1 codeprogrammingtool use | xAI | 60.5 Value / Price | 0.0 | 27.2 | 0.0 | 36.1 | 60.5 | $0.2 in / $1.5 out |
| 33 | Gemini 3.5 Flash-Lite gemini-3.5-flash-lite multimodalvisionmulti-input reasoning | Google | 59.1 Value / Price | 18.9 | 84.8 | 0.0 | 17.2 | 59.1 | |
| 34 | Nova 2 Lite nova-2-lite multimodalvisionmulti-input reasoning | Amazon | 59.1 Value / Price | 41.1 | 62.8 | 13.0 | 26.0 | 59.1 | $0.3 in / $2.5 out |
| 35 | Nova 2 Sonic nova-2-sonic multimodalvisionmulti-input reasoning | Amazon | 57.3 Value / Price | 0.0 | 62.8 | 0.0 | 0.0 | 57.3 | $0.33 in / $2.75 out |
| 36 | Mistral Large 3 (675B Instruct 2512) mistral-large-latest multimodalvisionmulti-input reasoning | Mistral AI | 55.6 Value / Price | 21.9 | 22.0 | 0.0 | 0.0 | 55.6 | |
| 37 | Gemini 3 Flash gemini-3-flash-preview multimodalvisionmulti-input reasoning | Google | 54.9 Value / Price | 68.5 | 62.8 | 33.2 | 61.9 | 54.9 | |
| 38 | Qwen3.6 Plus qwen3.6-plus multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 54.9 Value / Price | 66.9 | 62.8 | 33.6 | 52.8 | 54.9 | $0.5 in / $3 out |
| 39 | Seed 2.0 Pro seed-2.0-pro multimodalvisionmulti-input reasoning | ByteDance | 54.9 Value / Price | 66.8 | 23.2 | 44.8 | 56.0 | 54.9 | $0.5 in / $3 out |
| 40 | Grok 4.3 grok-4.3 textinference | xAI | 52.4 Value / Price | 0.0 | 62.8 | 0.0 | 0.0 | 52.4 | $1.25 in / $2.5 out |
MiniMax M2
MiniMax
73.2
$0.3 in / $1.2 out
MiniMax M2.7
MiniMax
73.2
$0.3 in / $1.2 out
MiniMax M3
MiniMax
73.2
$0.3 in / $1.2 out
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| $0.4 in / $1.6 out |
| $0.25 in / $2 out |
| $0.25 in / $1.5 out |
| $0.5 in / $1.5 out |
| $0.3 in / $2.5 out |
| $0.5 in / $1.5 out |
| $0.5 in / $3 out |
MiniMax M2.1
MiniMax
72.9
$0.3 in / $1.2 out
MiniMax M2.5
MiniMax
72.9
$0.3 in / $1.2 out
GPT-4.1 mini
OpenAI
69.5
$0.4 in / $1.6 out
Qwen3.7-Plus
Alibaba Cloud / Qwen Team
69.5
$0.32 in / $1.28 out
GPT-5 mini
OpenAI
68.5
$0.25 in / $2 out
Gemini 3.1 Flash-Lite
67.1
$0.25 in / $1.5 out
Qwen3.5-27B
Alibaba Cloud / Qwen Team
61.0
$0.3 in / $2.4 out
GPT-3.5 Turbo
OpenAI
60.7
$0.5 in / $1.5 out
Grok Code Fast 1
xAI
60.5
$0.2 in / $1.5 out
Gemini 3.5 Flash-Lite
59.1
$0.3 in / $2.5 out
Nova 2 Lite
Amazon
59.1
$0.3 in / $2.5 out
Nova 2 Sonic
Amazon
57.3
$0.33 in / $2.75 out
Mistral Large 3 (675B Instruct 2512)
Mistral AI
55.6
$0.5 in / $1.5 out
Gemini 3 Flash
54.9
$0.5 in / $3 out
Qwen3.6 Plus
Alibaba Cloud / Qwen Team
54.9
$0.5 in / $3 out
Seed 2.0 Pro
ByteDance
54.9
$0.5 in / $3 out
Grok 4.3
xAI
52.4
$1.25 in / $2.5 out