Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.
334
Tracked models
29
Providers
286
Benchmarked
15.1
Avg. index
334 models
| Rank | Model | Provider | Score | Benchmarks | Inference | Agentic | Programming | Value | Price |
|---|---|---|---|---|---|---|---|---|---|
| 321 | Qwen3 VL 235B A22B Instruct qwen3-vl-235b-a22b-instruct multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 34.3 | 0.0 | 51.0 | 0.0 | 0.0 | N/A |
| 322 | Qwen3 VL 235B A22B Thinking qwen3-vl-235b-a22b-thinking multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 35.2 | 0.0 | 36.2 | 0.0 | 0.0 | |
| 323 | Qwen3 VL 30B A3B Instruct qwen3-vl-30b-a3b-instruct multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 25.6 | 0.0 | 21.4 | 0.0 | 0.0 | |
| 324 | Qwen3 VL 30B A3B Thinking qwen3-vl-30b-a3b-thinking multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 32.7 | 0.0 | 19.2 | 0.0 | 0.0 | |
| 325 | Qwen3 VL 32B Instruct qwen3-vl-32b-instruct multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 26.5 | 0.0 | 25.1 | 0.0 | 0.0 | |
| 326 | Qwen3 VL 32B Thinking qwen3-vl-32b-thinking multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 41.2 | 0.0 | 31.1 | 0.0 | 0.0 | |
| 327 | Qwen3 VL 4B Instruct qwen3-vl-4b-instruct multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 18.2 | 32.9 | 17.7 | 0.0 | 85.4 | |
| 328 | Qwen3 VL 4B Thinking qwen3-vl-4b-thinking multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 20.2 | 32.9 | 17.0 | 0.0 | 79.3 | |
| 329 | Qwen3 VL 8B Instruct qwen3-vl-8b-instruct multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 8.0 | 0.0 | 24.0 | 0.0 | 0.0 | |
| 330 | Qwen3 VL 8B Thinking qwen3-vl-8b-thinking multimodalvisionmulti-input reasoning | Alibaba Cloud / Qwen Team | 0.0 Programming | 32.8 | 0.0 | 21.1 | 0.0 | 0.0 | |
| 331 | QwQ-32B qwq-32b textinference | Alibaba Cloud / Qwen Team | 0.0 Programming | 26.4 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 332 | QwQ-32B-Preview qwq-32b-preview textinference | Alibaba Cloud / Qwen Team | 0.0 Programming | 26.4 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 333 | Step3-VL-10B step3-vl-10b multimodalvisionmulti-input reasoning | StepFun | 0.0 Programming | 46.9 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
| 334 | U2 u2 textinference | Unisound | 0.0 Programming | 0.0 | 0.0 | 0.0 | 0.0 | 0.0 | N/A |
Qwen3 VL 235B A22B Instruct
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 235B A22B Thinking
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 30B A3B Instruct
Alibaba Cloud / Qwen Team
0.0
N/A
Page 17 of 17 · 334 models
Want benchmark charts, model comparison, and pricing analytics?
Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.
Open full leaderboardRankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.
| N/A |
| N/A |
| N/A |
| N/A |
| N/A |
| $0.1 in / $0.6 out |
| $0.1 in / $1 out |
| N/A |
| N/A |
Qwen3 VL 30B A3B Thinking
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 32B Instruct
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 32B Thinking
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 4B Instruct
Alibaba Cloud / Qwen Team
0.0
$0.1 in / $0.6 out
Qwen3 VL 4B Thinking
Alibaba Cloud / Qwen Team
0.0
$0.1 in / $1 out
Qwen3 VL 8B Instruct
Alibaba Cloud / Qwen Team
0.0
N/A
Qwen3 VL 8B Thinking
Alibaba Cloud / Qwen Team
0.0
N/A
QwQ-32B
Alibaba Cloud / Qwen Team
0.0
N/A
QwQ-32B-Preview
Alibaba Cloud / Qwen Team
0.0
N/A
Step3-VL-10B
StepFun
0.0
N/A
U2
Unisound
0.0
N/A