Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

15.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
241

Llama 3.2 90B Instruct

llama-3.2-90b-instruct

multimodalvisionmulti-input reasoning
MMeta

0.0

Programming

14.90.00.00.00.0N/A
242

Llama 3.3 70B Instruct

llama-3.3-70b-instruct

textinference
MMeta

0.0

Programming

18.00.00.00.00.0N/A
243

Llama-3.3 Nemotron Super 49B v1

llama-3.3-nemotron-super-49b-v1

textinference
NNVIDIA

0.0

Programming

21.30.00.00.00.0N/A
244

Llama 4 Maverick

llama-4-maverick

multimodalvisionmulti-input reasoning
MMeta

0.0

Programming

32.60.00.00.00.0N/A
245

Llama 4 Scout

llama-4-scout

multimodalvisionmulti-input reasoning
MMeta

0.0

Programming

27.60.00.00.00.0N/A
246

Magistral Medium

magistral-medium

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

20.60.00.00.00.0
247

Magistral Small 2506

magistral-small-2506

textinference
Mistral AI

0.0

Programming

22.70.00.00.00.0N/A
248

MedGemma 4B IT

medgemma-4b-it

multimodalvisionmulti-input reasoning
Google

0.0

Programming

0.00.00.00.00.0
249

MiniCPM-SALA

minicpm-sala

textinference
OOpenBMB

0.0

Programming

25.80.00.00.00.0N/A
250

Ministral 3 (14B Reasoning 2512)

ministral-14b-latest

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

35.40.00.00.00.0
251

Ministral 3 (14B Base 2512)

ministral-3-14b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
252

MiniStral 3 (14B Instruct 2512)

ministral-3-14b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
253

Ministral 3 (3B Base 2512)

ministral-3-3b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
254

Ministral 3 (3B Instruct 2512)

ministral-3-3b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
255

Ministral 3 (8B Base 2512)

ministral-3-8b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
256

Ministral 3 (8B Instruct 2512)

ministral-3-8b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

0.00.00.00.00.0
257

Min istral 3 (3B Reasoning 2512)

ministral-3b-latest

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

20.40.00.00.00.0
258

Ministral 8B Instruct

ministral-8b-instruct-2410

textinference
Mistral AI

0.0

Programming

0.00.00.00.00.0N/A
259

Ministral 3 (8B Reasoning 2512)

ministral-8b-latest

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Programming

29.40.00.00.00.0
260

Mistral Large 2

mistral-large-2-2407

textinference
Mistral AI

0.0

Programming

0.00.00.00.00.0N/A
241
M

Llama 3.2 90B Instruct

Meta

0.0

N/A

242
M

Llama 3.3 70B Instruct

Meta

0.0

N/A

243
N

Llama-3.3 Nemotron Super 49B v1

NVIDIA

0.0

N/A

244

Page 13 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

N/A
N/A
N/A
N/A
N/A
N/A
N/A
N/A
N/A
N/A
N/A
M

Llama 4 Maverick

Meta

0.0

N/A

245
M

Llama 4 Scout

Meta

0.0

N/A

246

Magistral Medium

Mistral AI

0.0

N/A

247

Magistral Small 2506

Mistral AI

0.0

N/A

248

MedGemma 4B IT

Google

0.0

N/A

249
O

MiniCPM-SALA

OpenBMB

0.0

N/A

250

Ministral 3 (14B Reasoning 2512)

Mistral AI

0.0

N/A

251

Ministral 3 (14B Base 2512)

Mistral AI

0.0

N/A

252

MiniStral 3 (14B Instruct 2512)

Mistral AI

0.0

N/A

253

Ministral 3 (3B Base 2512)

Mistral AI

0.0

N/A

254

Ministral 3 (3B Instruct 2512)

Mistral AI

0.0

N/A

255

Ministral 3 (8B Base 2512)

Mistral AI

0.0

N/A

256

Ministral 3 (8B Instruct 2512)

Mistral AI

0.0

N/A

257

Min istral 3 (3B Reasoning 2512)

Mistral AI

0.0

N/A

258

Ministral 8B Instruct

Mistral AI

0.0

N/A

259

Ministral 3 (8B Reasoning 2512)

Mistral AI

0.0

N/A

260

Mistral Large 2

Mistral AI

0.0

N/A