Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

15.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
201

Granite 3.3 8B Base

granite-3.3-8b-base

multimodalvisionmulti-input reasoning
IIBM

0.0

Programming

0.00.00.00.00.0N/A
202

Granite 3.3 8B Instruct

granite-3.3-8b-instruct

multimodalvisionmulti-input reasoning
IIBM

0.0

Programming

0.00.00.00.00.0N/A
203

IBM Granite 4.0 Tiny Preview

granite-4.0-tiny-preview

textinference
IIBM

0.0

Programming

0.00.00.00.00.0N/A
204

Grok-1.5

grok-1.5

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

8.20.00.00.00.0N/A
205

Grok-1.5V

grok-1.5v

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

9.70.00.00.00.0N/A
206

Grok-2

grok-2

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

25.70.00.00.00.0N/A
207

Grok-2 Image 1212

grok-2-image-1212

textinference
xAI

0.0

Programming

0.00.00.00.00.0N/A
208

Grok-2 mini

grok-2-mini

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

22.80.00.00.00.0N/A
209

Grok-3

grok-3

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

58.450.20.00.024.1$3 in / $15 out
210

Grok-3 Mini

grok-3-mini

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

51.00.00.00.00.0N/A
211

Grok-4

grok-4

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

49.10.00.00.00.0N/A
212

Grok-4.1

grok-4.1-2025-11-17

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.00.00.00.00.0N/A
213

Grok-4.1 Fast Non-Reasoning

grok-4-1-fast-non-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.063.00.00.077.3
214

Grok-4.1 Fast Reasoning

grok-4-1-fast-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.063.00.00.077.3
215

Grok-4.1 Thinking

grok-4.1-thinking-2025-11-17

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.00.00.00.00.0
216

Grok-4.20 Beta Non-Reasoning

grok-4.20-beta-0309-non-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.00.00.00.00.0
217

Grok-4.20 Beta Reasoning

grok-4.20-beta-0309-reasoning

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.00.00.00.00.0
218

Grok-4.20 Multi-Agent Beta

grok-4.20-multi-agent-beta-0309

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

0.00.00.00.00.0
219

Grok 4.3

grok-4.3

textinference
xAI

0.0

Programming

0.062.80.00.052.4$1.25 in / $2.5 out
220

Grok 4 Fast

grok-4-fast

multimodalvisionmulti-input reasoning
xAI

0.0

Programming

55.70.012.80.00.0N/A
201
I

Granite 3.3 8B Base

IBM

0.0

N/A

202
I

Granite 3.3 8B Instruct

IBM

0.0

N/A

203
I

IBM Granite 4.0 Tiny Preview

IBM

0.0

N/A

204

Page 11 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.2 in / $0.5 out
$0.2 in / $0.5 out
N/A
N/A
N/A
N/A

Grok-1.5

xAI

0.0

N/A

205

Grok-1.5V

xAI

0.0

N/A

206

Grok-2

xAI

0.0

N/A

207

Grok-2 Image 1212

xAI

0.0

N/A

208

Grok-2 mini

xAI

0.0

N/A

209

Grok-3

xAI

0.0

$3 in / $15 out

210

Grok-3 Mini

xAI

0.0

N/A

211

Grok-4

xAI

0.0

N/A

212

Grok-4.1

xAI

0.0

N/A

213

Grok-4.1 Fast Non-Reasoning

xAI

0.0

$0.2 in / $0.5 out

214

Grok-4.1 Fast Reasoning

xAI

0.0

$0.2 in / $0.5 out

215

Grok-4.1 Thinking

xAI

0.0

N/A

216

Grok-4.20 Beta Non-Reasoning

xAI

0.0

N/A

217

Grok-4.20 Beta Reasoning

xAI

0.0

N/A

218

Grok-4.20 Multi-Agent Beta

xAI

0.0

N/A

219

Grok 4.3

xAI

0.0

$1.25 in / $2.5 out

220

Grok 4 Fast

xAI

0.0

N/A