Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

28.3

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
301

Grok-4.20 Beta Non-Reasoning

grok-4.20-beta-0309-non-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Benchmarks

0.00.00.00.00.0N/A
302

Grok-4.20 Beta Reasoning

grok-4.20-beta-0309-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Benchmarks

0.00.00.00.00.0
303

Grok-4.20 Multi-Agent Beta

grok-4.20-multi-agent-beta-0309

multimodalvisionmulti-input reasoning
xAI

0.0

Benchmarks

0.00.00.00.00.0
304

Grok 4.3

grok-4.3

textinference
xAI

0.0

Benchmarks

0.062.80.00.052.4$1.25 in / $2.5 out
305

Grok-4 Fast Non-Reasoning

grok-4-fast-non-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Benchmarks

0.00.00.00.00.0
306

Grok-4 Fast Reasoning

grok-4-fast-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Benchmarks

0.063.00.00.077.3
307

Grok Code Fast 1

grok-code-fast-1

codeprogrammingtool use
xAI

0.0

Benchmarks

0.027.20.036.160.5$0.2 in / $1.5 out
308

Kimi K2.7 Code

kimi-k2.7-code

multimodalvisionmulti-input reasoning
Moonshot AI

0.0

Benchmarks

0.032.947.20.047.6
309

Llama 3.1 Nemotron 70B Instruct

llama-3.1-nemotron-70b-instruct

textinference
NNVIDIA

0.0

Benchmarks

0.00.00.00.00.0N/A
310

MedGemma 4B IT

medgemma-4b-it

multimodalvisionmulti-input reasoning
Google

0.0

Benchmarks

0.00.00.00.00.0
311

MiMo-V2-Omni

mimo-v2-omni

multimodalvisionmulti-input reasoning
Xiaomi

0.0

Benchmarks

0.00.00.050.90.0N/A
312

MiMo-V2-Pro

mimo-v2-pro

codeprogrammingtool use
Xiaomi

0.0

Benchmarks

0.00.00.061.90.0N/A
313

MiniMax M2.5

minimax-m2.5

codeprogrammingtool use
MiniMax

0.0

Benchmarks

0.068.943.650.472.9$0.3 in / $1.2 out
314

MiniMax M2.7

minimax-m2.7

codeprogrammingtool use
MiniMax

0.0

Benchmarks

0.019.526.329.073.2$0.3 in / $1.2 out
315

Ministral 3 (14B Base 2512)

ministral-3-14b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
316

MiniStral 3 (14B Instruct 2512)

ministral-3-14b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
317

Ministral 3 (3B Base 2512)

ministral-3-3b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
318

Ministral 3 (3B Instruct 2512)

ministral-3-3b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
319

Ministral 3 (8B Base 2512)

ministral-3-8b-base-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
320

Ministral 3 (8B Instruct 2512)

ministral-3-8b-instruct-2512

multimodalvisionmulti-input reasoning
Mistral AI

0.0

Benchmarks

0.00.00.00.00.0
301

Grok-4.20 Beta Non-Reasoning

xAI

0.0

N/A

302

Grok-4.20 Beta Reasoning

xAI

0.0

N/A

303

Grok-4.20 Multi-Agent Beta

xAI

0.0

N/A

304

Page 16 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

N/A
N/A
N/A
$0.2 in / $0.5 out
$0.74 in / $3.5 out
N/A
N/A
N/A
N/A
N/A
N/A
N/A

Grok 4.3

xAI

0.0

$1.25 in / $2.5 out

305

Grok-4 Fast Non-Reasoning

xAI

0.0

N/A

306

Grok-4 Fast Reasoning

xAI

0.0

$0.2 in / $0.5 out

307

Grok Code Fast 1

xAI

0.0

$0.2 in / $1.5 out

308

Kimi K2.7 Code

Moonshot AI

0.0

$0.74 in / $3.5 out

309
N

Llama 3.1 Nemotron 70B Instruct

NVIDIA

0.0

N/A

310

MedGemma 4B IT

Google

0.0

N/A

311

MiMo-V2-Omni

Xiaomi

0.0

N/A

312

MiMo-V2-Pro

Xiaomi

0.0

N/A

313

MiniMax M2.5

MiniMax

0.0

$0.3 in / $1.2 out

314

MiniMax M2.7

MiniMax

0.0

$0.3 in / $1.2 out

315

Ministral 3 (14B Base 2512)

Mistral AI

0.0

N/A

316

MiniStral 3 (14B Instruct 2512)

Mistral AI

0.0

N/A

317

Ministral 3 (3B Base 2512)

Mistral AI

0.0

N/A

318

Ministral 3 (3B Instruct 2512)

Mistral AI

0.0

N/A

319

Ministral 3 (8B Base 2512)

Mistral AI

0.0

N/A

320

Ministral 3 (8B Instruct 2512)

Mistral AI

0.0

N/A