Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

12.6

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
21

MiniMax M2

minimax-m2

codeprogrammingtool use
MiniMax

73.2

Value / Price

29.862.840.240.073.2$0.3 in / $1.2 out
22

MiniMax M2.7

minimax-m2.7

codeprogrammingtool use
MiniMax

73.2

Value / Price

0.019.526.329.073.2$0.3 in / $1.2 out
23

MiniMax M3

minimax-m3

multimodalvisionmulti-input reasoning
MiniMax

73.2

Value / Price

49.662.837.568.373.2$0.3 in / $1.2 out
24

MiniMax M2.1

minimax-m2.1

codeprogrammingtool use
MiniMax

72.9

Value / Price

39.168.945.747.672.9$0.3 in / $1.2 out
25

MiniMax M2.5

minimax-m2.5

codeprogrammingtool use
MiniMax

72.9

Value / Price

0.068.943.650.472.9$0.3 in / $1.2 out
26

GPT-4.1 mini

gpt-4.1-mini-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

69.5

Value / Price

19.284.68.92.269.5
27

Qwen3.7-Plus

qwen3.7-plus

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

69.5

Value / Price

62.962.848.161.169.5$0.32 in / $1.28 out
28

GPT-5 mini

gpt-5-mini-2025-08-07

multimodalvisionmulti-input reasoning
OpenAI

68.5

Value / Price

39.477.40.022.268.5
29

Gemini 3.1 Flash-Lite

gemini-3.1-flash-lite-preview

multimodalvisionmulti-input reasoning
Google

67.1

Value / Price

52.662.80.00.067.1
30

Qwen3.5-27B

qwen3.5-27b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

61.0

Value / Price

57.832.941.339.161.0$0.3 in / $2.4 out
31

GPT-3.5 Turbo

gpt-3.5-turbo-0125

multimodalvisionmulti-input reasoning
OpenAI

60.7

Value / Price

2.330.10.00.060.7
32

Grok Code Fast 1

grok-code-fast-1

codeprogrammingtool use
xAI

60.5

Value / Price

0.027.20.036.160.5$0.2 in / $1.5 out
33

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite

multimodalvisionmulti-input reasoning
Google

59.1

Value / Price

18.984.80.017.259.1
34

Nova 2 Lite

nova-2-lite

multimodalvisionmulti-input reasoning
AAmazon

59.1

Value / Price

41.162.813.026.059.1$0.3 in / $2.5 out
35

Nova 2 Sonic

nova-2-sonic

multimodalvisionmulti-input reasoning
AAmazon

57.3

Value / Price

0.062.80.00.057.3$0.33 in / $2.75 out
36

Mistral Large 3 (675B Instruct 2512)

mistral-large-latest

multimodalvisionmulti-input reasoning
Mistral AI

55.6

Value / Price

21.922.00.00.055.6
37

Gemini 3 Flash

gemini-3-flash-preview

multimodalvisionmulti-input reasoning
Google

54.9

Value / Price

68.562.833.261.954.9
38

Qwen3.6 Plus

qwen3.6-plus

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

54.9

Value / Price

66.962.833.652.854.9$0.5 in / $3 out
39

Seed 2.0 Pro

seed-2.0-pro

multimodalvisionmulti-input reasoning
BByteDance

54.9

Value / Price

66.823.244.856.054.9$0.5 in / $3 out
40

Grok 4.3

grok-4.3

textinference
xAI

52.4

Value / Price

0.062.80.00.052.4$1.25 in / $2.5 out
21

MiniMax M2

MiniMax

73.2

$0.3 in / $1.2 out

22

MiniMax M2.7

MiniMax

73.2

$0.3 in / $1.2 out

23

MiniMax M3

MiniMax

73.2

$0.3 in / $1.2 out

24

Page 2 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.4 in / $1.6 out
$0.25 in / $2 out
$0.25 in / $1.5 out
$0.5 in / $1.5 out
$0.3 in / $2.5 out
$0.5 in / $1.5 out
$0.5 in / $3 out

MiniMax M2.1

MiniMax

72.9

$0.3 in / $1.2 out

25

MiniMax M2.5

MiniMax

72.9

$0.3 in / $1.2 out

26

GPT-4.1 mini

OpenAI

69.5

$0.4 in / $1.6 out

27
A

Qwen3.7-Plus

Alibaba Cloud / Qwen Team

69.5

$0.32 in / $1.28 out

28

GPT-5 mini

OpenAI

68.5

$0.25 in / $2 out

29

Gemini 3.1 Flash-Lite

Google

67.1

$0.25 in / $1.5 out

30
A

Qwen3.5-27B

Alibaba Cloud / Qwen Team

61.0

$0.3 in / $2.4 out

31

GPT-3.5 Turbo

OpenAI

60.7

$0.5 in / $1.5 out

32

Grok Code Fast 1

xAI

60.5

$0.2 in / $1.5 out

33

Gemini 3.5 Flash-Lite

Google

59.1

$0.3 in / $2.5 out

34
A

Nova 2 Lite

Amazon

59.1

$0.3 in / $2.5 out

35
A

Nova 2 Sonic

Amazon

57.3

$0.33 in / $2.75 out

36

Mistral Large 3 (675B Instruct 2512)

Mistral AI

55.6

$0.5 in / $1.5 out

37

Gemini 3 Flash

Google

54.9

$0.5 in / $3 out

38
A

Qwen3.6 Plus

Alibaba Cloud / Qwen Team

54.9

$0.5 in / $3 out

39
B

Seed 2.0 Pro

ByteDance

54.9

$0.5 in / $3 out

40

Grok 4.3

xAI

52.4

$1.25 in / $2.5 out