Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

13.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
281

Phi 4 Mini Reasoning

phi-4-mini-reasoning

textinference
MMicrosoft

0.0

Inference

19.90.00.00.00.0N/A
282

Phi-4-multimodal-instruct

phi-4-multimodal-instruct

multimodalvisionmulti-input reasoning
MMicrosoft

0.0

Inference

8.00.00.00.00.0N/A
283

Phi 4 Reasoning

phi-4-reasoning

textinference
MMicrosoft

0.0

Inference

21.30.00.00.00.0N/A
284

Phi 4 Reasoning Plus

phi-4-reasoning-plus

textinference
MMicrosoft

0.0

Inference

29.40.00.00.00.0N/A
285

Pixtral-12B

pixtral-12b-2409

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Inference

8.00.00.00.00.0
286

Pixtral Large

pixtral-large

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Inference

27.30.00.00.00.0
287

QvQ-72B-Preview

qvq-72b-preview

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

37.60.00.00.00.0N/A
288

Qwen2.5 14B Instruct

qwen-2.5-14b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

13.40.00.00.00.0N/A
289

Qwen2.5 32B Instruct

qwen-2.5-32b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

17.10.00.00.00.0N/A
290

Qwen2.5 72B Instruct

qwen-2.5-72b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

16.30.00.00.00.0N/A
291

Qwen2.5 7B Instruct

qwen-2.5-7b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

6.80.00.00.00.0N/A
292

Qwen2.5-Coder 32B Instruct

qwen-2.5-coder-32b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

0.00.00.00.00.0N/A
293

Qwen2.5-Coder 7B Instruct

qwen-2.5-coder-7b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

0.00.00.00.00.0N/A
294

Qwen2.5-Omni-7B

qwen2.5-omni-7b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

7.20.00.00.00.0N/A
295

Qwen2.5 VL 32B Instruct

qwen2.5-vl-32b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

19.40.01.50.00.0N/A
296

Qwen2.5 VL 72B Instruct

qwen2.5-vl-72b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

22.70.05.20.00.0N/A
297

Qwen2.5 VL 7B Instruct

qwen2.5-vl-7b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

9.00.00.00.00.0N/A
298

Qwen2 72B Instruct

qwen2-72b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

11.00.00.00.00.0N/A
299

Qwen2 7B Instruct

qwen2-7b-instruct

textinference
AAlibaba Cloud / Qwen Team

0.0

Inference

2.20.00.00.00.0N/A
300

Qwen2-VL-72B-Instruct

qwen2-vl-72b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

0.0

Inference

6.80.00.00.00.0N/A
281
M

Phi 4 Mini Reasoning

Microsoft

0.0

N/A

282
M

Phi-4-multimodal-instruct

Microsoft

0.0

N/A

283
M

Phi 4 Reasoning

Microsoft

0.0

N/A

284

Page 15 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

N/A
N/A
M

Phi 4 Reasoning Plus

Microsoft

0.0

N/A

285

Pixtral-12B

Mistral AI

0.0

N/A

286

Pixtral Large

Mistral AI

0.0

N/A

287
A

QvQ-72B-Preview

Alibaba Cloud / Qwen Team

0.0

N/A

288
A

Qwen2.5 14B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

289
A

Qwen2.5 32B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

290
A

Qwen2.5 72B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

291
A

Qwen2.5 7B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

292
A

Qwen2.5-Coder 32B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

293
A

Qwen2.5-Coder 7B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

294
A

Qwen2.5-Omni-7B

Alibaba Cloud / Qwen Team

0.0

N/A

295
A

Qwen2.5 VL 32B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

296
A

Qwen2.5 VL 72B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

297
A

Qwen2.5 VL 7B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

298
A

Qwen2 72B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

299
A

Qwen2 7B Instruct

Alibaba Cloud / Qwen Team

0.0

N/A

300
A

Qwen2-VL-72B-Instruct

Alibaba Cloud / Qwen Team

0.0

N/A