Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

12.6

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
41

GLM-5.2

glm-5.2

codeprogrammingtool use
ZZhipu AI

51.2

Value / Price

68.784.844.159.951.2$0.95 in / $3 out
42

Qwen3.6-27B

qwen3.6-27b

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

49.4

Value / Price

54.732.90.039.449.4$0.6 in / $3.6 out
43

Kimi K2.7 Code

kimi-k2.7-code

multimodalvisionmulti-input reasoning
Moonshot AI

47.6

Value / Price

0.032.947.20.047.6
44

Kimi K2.6

kimi-k2.6

texttext-to-textlanguage
Moonshot AI

46.3

Value / Price

63.532.947.269.446.3
45

Claude Haiku 4.5

claude-haiku-4-5-20251001

multimodalvisionmulti-input reasoning
Anthropic

45.6

Value / Price

30.853.350.853.945.6
46

DeepSeek-V4-Pro-Max

deepseek-v4-pro-max

codeprogrammingtool use
DeepSeek

45.1

Value / Price

64.984.851.052.045.1
47

Qwen3.7 Max

qwen3.7-max

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

43.9

Value / Price

64.762.849.674.243.9$1.25 in / $3.75 out
48

GPT-5.4 Mini

gpt-5.4-mini

texttext-to-textlanguage
OpenAI

42.7

Value / Price

51.144.515.020.042.7
49

Muse Spark 1.1

muse-spark-1.1

multimodalvisionmulti-input reasoning
MMeta

41.5

Value / Price

69.784.876.658.141.5$1.25 in / $4.25 out
50

GPT-4.1

gpt-4.1-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

40.7

Value / Price

27.273.232.814.740.7
51

GLM-5.1

glm-5.1

codeprogrammingtool use
ZZhipu AI

40.2

Value / Price

62.615.935.247.240.2$1.4 in / $4.4 out
52

GLM-5

glm-5

codeprogrammingtool use
ZZhipu AI

40.0

Value / Price

0.06.935.160.440.0$1 in / $3.2 out
53

GPT-5.6 Luna

gpt-5.6-luna

multimodalvisionmulti-input reasoning
OpenAI

37.8

Value / Price

63.994.555.065.537.8
54

GPT-5.1

gpt-5.1-2025-11-13

multimodalvisionmulti-input reasoning
OpenAI

37.3

Value / Price

62.462.80.051.437.3
55

GPT-5.1 Instant

gpt-5.1-instant-2025-11-12

multimodalvisionmulti-input reasoning
OpenAI

37.3

Value / Price

62.462.80.051.437.3
56

Grok 4.5

grok-4.5

multimodalvisionmulti-input reasoning
xAI

35.6

Value / Price

69.338.20.070.835.6$2 in / $6 out
57

Gemini 3.6 Flash

gemini-3.6-flash

multimodalvisionmulti-input reasoning
Google

34.8

Value / Price

57.884.80.052.634.8
58

Mistral Medium 3.5

mistral-medium-3-5

multimodalvisionmulti-input reasoning
Mistral AI

34.8

Value / Price

34.623.215.459.034.8
59

GPT-5.1 Medium

gpt-5.1-medium-2025-11-12

multimodalvisionmulti-input reasoning
OpenAI

32.0

Value / Price

64.144.90.00.032.0
60

Gemini 3.5 Flash

gemini-3.5-flash

multimodalvisionmulti-input reasoning
Google

31.7

Value / Price

60.284.867.321.831.7
41
Z

GLM-5.2

Zhipu AI

51.2

$0.95 in / $3 out

42
A

Qwen3.6-27B

Alibaba Cloud / Qwen Team

49.4

$0.6 in / $3.6 out

43

Kimi K2.7 Code

Moonshot AI

47.6

$0.74 in / $3.5 out

44

Page 3 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.74 in / $3.5 out
$0.75 in / $3.5 out
$1 in / $5 out
$1.6 in / $3.2 out
$0.75 in / $4.5 out
$2 in / $8 out
$1 in / $6 out
$1.25 in / $10 out
$1.25 in / $10 out
$1.5 in / $7.5 out
$1.5 in / $7.5 out
$1.25 in / $10 out
$1.5 in / $9 out

Kimi K2.6

Moonshot AI

46.3

$0.75 in / $3.5 out

45

Claude Haiku 4.5

Anthropic

45.6

$1 in / $5 out

46

DeepSeek-V4-Pro-Max

DeepSeek

45.1

$1.6 in / $3.2 out

47
A

Qwen3.7 Max

Alibaba Cloud / Qwen Team

43.9

$1.25 in / $3.75 out

48

GPT-5.4 Mini

OpenAI

42.7

$0.75 in / $4.5 out

49
M

Muse Spark 1.1

Meta

41.5

$1.25 in / $4.25 out

50

GPT-4.1

OpenAI

40.7

$2 in / $8 out

51
Z

GLM-5.1

Zhipu AI

40.2

$1.4 in / $4.4 out

52
Z

GLM-5

Zhipu AI

40.0

$1 in / $3.2 out

53

GPT-5.6 Luna

OpenAI

37.8

$1 in / $6 out

54

GPT-5.1

OpenAI

37.3

$1.25 in / $10 out

55

GPT-5.1 Instant

OpenAI

37.3

$1.25 in / $10 out

56

Grok 4.5

xAI

35.6

$2 in / $6 out

57

Gemini 3.6 Flash

Google

34.8

$1.5 in / $7.5 out

58

Mistral Medium 3.5

Mistral AI

34.8

$1.5 in / $7.5 out

59

GPT-5.1 Medium

OpenAI

32.0

$1.25 in / $10 out

60

Gemini 3.5 Flash

Google

31.7

$1.5 in / $9 out