Skytells
  • Home
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Pricing
  • ModelsNew
  • EveNew
  • CLI

Platform

  • DropsNew
  • Cognition
  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network

Resources

  • Documentation
  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Trust Center
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

373

Tracked models

34

Providers

310

Benchmarked

15.4

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

373 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
1

Claude Fable 5

claude-fable-5

multimodalvisionmulti-input reasoning
Anthropic

84.2

Programming

69.558.60.084.21.9$10 in / $50 out
2

Claude Mythos Preview

claude-mythos-preview

multimodalvisionmulti-input reasoning
Anthropic

83.0

Programming

79.50.064.883.00.0
3

Claude Opus 4.8

claude-opus-4-8

multimodalvisionmulti-input reasoning
Anthropic

81.8

Programming

72.526.768.781.89.5
4

Claude Opus 4.7

claude-opus-4-7

multimodalvisionmulti-input reasoning
Anthropic

77.5

Programming

74.326.752.977.59.5
5

Claude Sonnet 5

claude-sonnet-5

multimodalvisionmulti-input reasoning
Anthropic

75.5

Programming

64.026.753.475.521.6
6

Claude Sonnet 4.5

claude-sonnet-4-5-20250929

multimodalvisionmulti-input reasoning
Anthropic

74.6

Programming

50.711.669.974.612.6
7

Qwen3.7 Max

qwen3.7-max

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

74.4

Programming

64.058.648.074.440.8$1.25 in / $3.75 out
8

GPT-5.6 Sol

gpt-5.6-sol

multimodalvisionmulti-input reasoning
OpenAI

72.7

Programming

77.695.263.172.75.8$5 in / $30 out
9

Claude Opus 4.5

claude-opus-4-5-20251101

multimodalvisionmulti-input reasoning
Anthropic

72.5

Programming

52.60.034.272.50.0
10

Qwen3.8 Max

qwen3.8-max

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

72.0

Programming

70.381.962.772.035.0$1.65 in / $4.951 out
11

Claude Opus 4.6

claude-opus-4-6

multimodalvisionmulti-input reasoning
Anthropic

71.9

Programming

72.226.748.871.99.5
12

Hy4 preview

hy4-preview

codeprogrammingtool use
TTencent

70.6

Programming

67.20.070.370.60.0N/A
13

Kimi K2.6

kimi-k2.6

texttext-to-textlanguage
Moonshot AI

70.0

Programming

61.830.540.970.044.7
14

GPT-5.6 Terra

gpt-5.6-terra

multimodalvisionmulti-input reasoning
OpenAI

69.3

Programming

72.595.254.669.321.4
15

Grok 4.5

grok-4.5

multimodalvisionmulti-input reasoning
xAI

69.2

Programming

69.137.90.069.233.5$2 in / $6 out
16

MiniMax M3

minimax-m3

multimodalvisionmulti-input reasoning
MiniMax

66.5

Programming

50.158.634.966.565.0$0.3 in / $1.2 out
17

GPT-5.2

gpt-5.2-2025-12-11

multimodalvisionmulti-input reasoning
OpenAI

66.3

Programming

69.858.934.366.328.7
18

Claude Sonnet 4.6

claude-sonnet-4-6

multimodalvisionmulti-input reasoning
Anthropic

65.8

Programming

61.611.640.365.812.6
19

GPT-5.6 Luna

gpt-5.6-luna

multimodalvisionmulti-input reasoning
OpenAI

65.8

Programming

62.795.248.565.870.4
20

Gemini 3.1 Pro

gemini-3.1-pro-preview

multimodalvisionmulti-input reasoning
Google

62.9

Programming

70.557.546.262.921.9
1

Claude Fable 5

Anthropic

84.2

$10 in / $50 out

2

Claude Mythos Preview

Anthropic

83.0

N/A

3

Claude Opus 4.8

Anthropic

81.8

$5 in / $25 out

Page 1 of 19 · 373 models

Next

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

N/A
$5 in / $25 out
$5 in / $25 out
$2 in / $10 out
$3 in / $15 out
N/A
$5 in / $25 out
$0.75 in / $3.5 out
$2 in / $12 out
$1.75 in / $14 out
$3 in / $15 out
$0.2 in / $1.2 out
$2.5 in / $15 out
4

Claude Opus 4.7

Anthropic

77.5

$5 in / $25 out

5

Claude Sonnet 5

Anthropic

75.5

$2 in / $10 out

6

Claude Sonnet 4.5

Anthropic

74.6

$3 in / $15 out

7
A

Qwen3.7 Max

Alibaba Cloud / Qwen Team

74.4

$1.25 in / $3.75 out

8

GPT-5.6 Sol

OpenAI

72.7

$5 in / $30 out

9

Claude Opus 4.5

Anthropic

72.5

N/A

10
A

Qwen3.8 Max

Alibaba Cloud / Qwen Team

72.0

$1.65 in / $4.951 out

11

Claude Opus 4.6

Anthropic

71.9

$5 in / $25 out

12
T

Hy4 preview

Tencent

70.6

N/A

13

Kimi K2.6

Moonshot AI

70.0

$0.75 in / $3.5 out

14

GPT-5.6 Terra

OpenAI

69.3

$2 in / $12 out

15

Grok 4.5

xAI

69.2

$2 in / $6 out

16

MiniMax M3

MiniMax

66.5

$0.3 in / $1.2 out

17

GPT-5.2

OpenAI

66.3

$1.75 in / $14 out

18

Claude Sonnet 4.6

Anthropic

65.8

$3 in / $15 out

19

GPT-5.6 Luna

OpenAI

65.8

$0.2 in / $1.2 out

20

Gemini 3.1 Pro

Google

62.9

$2.5 in / $15 out