Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

13.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
21

MiniMax M2.1

minimax-m2.1

codeprogrammingtool use
MiniMax

68.9

Inference

39.168.945.747.672.9$0.3 in / $1.2 out
22

MiniMax M2.5

minimax-m2.5

codeprogrammingtool use
MiniMax

68.9

Inference

0.068.943.650.472.9$0.3 in / $1.2 out
23

Grok-4.1 Fast Non-Reasoning

grok-4-1-fast-non-reasoning

multimodalvisionmulti-input reasoning
xAI

63.0

Inference

0.063.00.00.077.3
24

Grok-4.1 Fast Reasoning

grok-4-1-fast-reasoning

multimodalvisionmulti-input reasoning
xAI

63.0

Inference

0.063.00.00.077.3
25

Grok-4 Fast Reasoning

grok-4-fast-reasoning

multimodalvisionmulti-input reasoning
xAI

63.0

Inference

0.063.00.00.077.3
26

Claude Fable 5

claude-fable-5

multimodalvisionmulti-input reasoning
Anthropic

62.8

Inference

70.862.80.084.20.0
27

Gemini 3.1 Flash-Lite

gemini-3.1-flash-lite-preview

multimodalvisionmulti-input reasoning
Google

62.8

Inference

52.662.80.00.067.1
28

Gemini 3 Flash

gemini-3-flash-preview

multimodalvisionmulti-input reasoning
Google

62.8

Inference

68.562.833.261.954.9
29

GPT-5.1

gpt-5.1-2025-11-13

multimodalvisionmulti-input reasoning
OpenAI

62.8

Inference

62.462.80.051.437.3
30

GPT-5.1 Instant

gpt-5.1-instant-2025-11-12

multimodalvisionmulti-input reasoning
OpenAI

62.8

Inference

62.462.80.051.437.3
31

GPT-5.2

gpt-5.2-2025-12-11

multimodalvisionmulti-input reasoning
OpenAI

62.8

Inference

70.962.837.066.331.5
32

GPT-5.5 Instant

gpt-5.5-instant

multimodalvisionmulti-input reasoning
OpenAI

62.8

Inference

49.562.80.00.017.3
33

Grok 4.3

grok-4.3

textinference
xAI

62.8

Inference

0.062.80.00.052.4$1.25 in / $2.5 out
34

MiniMax M2

minimax-m2

codeprogrammingtool use
MiniMax

62.8

Inference

29.862.840.240.073.2$0.3 in / $1.2 out
35

MiniMax M3

minimax-m3

multimodalvisionmulti-input reasoning
MiniMax

62.8

Inference

49.662.837.568.373.2$0.3 in / $1.2 out
36

Nova 2 Lite

nova-2-lite

multimodalvisionmulti-input reasoning
AAmazon

62.8

Inference

41.162.813.026.059.1$0.3 in / $2.5 out
37

Nova 2 Sonic

nova-2-sonic

multimodalvisionmulti-input reasoning
AAmazon

62.8

Inference

0.062.80.00.057.3$0.33 in / $2.75 out
38

Qwen3.6 Plus

qwen3.6-plus

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

62.8

Inference

66.962.833.652.854.9$0.5 in / $3 out
39

Qwen3.7 Max

qwen3.7-max

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

62.8

Inference

64.762.849.674.243.9$1.25 in / $3.75 out
40

Qwen3.7-Plus

qwen3.7-plus

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

62.8

Inference

62.962.848.161.169.5$0.32 in / $1.28 out
21

MiniMax M2.1

MiniMax

68.9

$0.3 in / $1.2 out

22

MiniMax M2.5

MiniMax

68.9

$0.3 in / $1.2 out

23

Grok-4.1 Fast Non-Reasoning

xAI

63.0

$0.2 in / $0.5 out

24

Page 2 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.2 in / $0.5 out
$0.2 in / $0.5 out
$0.2 in / $0.5 out
$10 in / $50 out
$0.25 in / $1.5 out
$0.5 in / $3 out
$1.25 in / $10 out
$1.25 in / $10 out
$1.75 in / $14 out
$5 in / $30 out

Grok-4.1 Fast Reasoning

xAI

63.0

$0.2 in / $0.5 out

25

Grok-4 Fast Reasoning

xAI

63.0

$0.2 in / $0.5 out

26

Claude Fable 5

Anthropic

62.8

$10 in / $50 out

27

Gemini 3.1 Flash-Lite

Google

62.8

$0.25 in / $1.5 out

28

Gemini 3 Flash

Google

62.8

$0.5 in / $3 out

29

GPT-5.1

OpenAI

62.8

$1.25 in / $10 out

30

GPT-5.1 Instant

OpenAI

62.8

$1.25 in / $10 out

31

GPT-5.2

OpenAI

62.8

$1.75 in / $14 out

32

GPT-5.5 Instant

OpenAI

62.8

$5 in / $30 out

33

Grok 4.3

xAI

62.8

$1.25 in / $2.5 out

34

MiniMax M2

MiniMax

62.8

$0.3 in / $1.2 out

35

MiniMax M3

MiniMax

62.8

$0.3 in / $1.2 out

36
A

Nova 2 Lite

Amazon

62.8

$0.3 in / $2.5 out

37
A

Nova 2 Sonic

Amazon

62.8

$0.33 in / $2.75 out

38
A

Qwen3.6 Plus

Alibaba Cloud / Qwen Team

62.8

$0.5 in / $3 out

39
A

Qwen3.7 Max

Alibaba Cloud / Qwen Team

62.8

$1.25 in / $3.75 out

40
A

Qwen3.7-Plus

Alibaba Cloud / Qwen Team

62.8

$0.32 in / $1.28 out