Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

12.2

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
1

Kimi K3

kimi-k3

multimodalvisionmulti-input reasoning
Moonshot AI

84.2

Agentic

76.184.884.20.012.2$3 in / $15 out
2

Muse Spark 1.1

muse-spark-1.1

multimodalvisionmulti-input reasoning
MMeta

76.6

Agentic

69.784.876.658.141.5$1.25 in / $4.25 out
3

Seed 2.1 Pro

seed-2.1-pro

multimodalvisionmulti-input reasoning
BByteDance

75.6

Agentic

69.20.075.660.20.0N/A
4

Claude Opus 4.8

claude-opus-4-8

multimodalvisionmulti-input reasoning
Anthropic

74.5

Agentic

74.428.374.581.38.0
5

GPT-5.6 Sol

gpt-5.6-sol

multimodalvisionmulti-input reasoning
OpenAI

71.4

Agentic

79.894.571.473.73.7$5 in / $30 out
6

Claude Sonnet 4.5

claude-sonnet-4-5-20250929

multimodalvisionmulti-input reasoning
Anthropic

69.9

Agentic

51.412.669.974.612.0
7

GPT-5.5 Pro

gpt-5.5-pro

multimodalvisionmulti-input reasoning
OpenAI

69.2

Agentic

61.10.069.248.80.0N/A
8

Claude Opus 4.1

claude-opus-4-1-20250805

multimodalvisionmulti-input reasoning
Anthropic

67.4

Agentic

46.00.067.460.80.0
9

Gemini 3.5 Flash

gemini-3.5-flash

multimodalvisionmulti-input reasoning
Google

67.3

Agentic

60.284.867.321.831.7
10

Claude Mythos Preview

claude-mythos-preview

multimodalvisionmulti-input reasoning
Anthropic

66.6

Agentic

80.00.066.682.70.0
11

Muse Spark

muse-spark

multimodalvisionmulti-input reasoning
MMeta

64.4

Agentic

67.10.064.436.20.0N/A
12

Seed 2.1 Turbo

seed-2.1-turbo

multimodalvisionmulti-input reasoning
BByteDance

63.1

Agentic

66.30.063.153.80.0N/A
13

GPT-5.6 Terra

gpt-5.6-terra

multimodalvisionmulti-input reasoning
OpenAI

61.5

Agentic

74.694.561.569.617.1
14

GPT-5.5

gpt-5.5

multimodalvisionmulti-input reasoning
OpenAI

61.0

Agentic

76.794.561.051.23.7$5 in / $30 out
15

Claude Sonnet 5

claude-sonnet-5

multimodalvisionmulti-input reasoning
Anthropic

60.7

Agentic

67.528.360.775.412.0
16

Gemini 3 Pro

gemini-3-pro-preview

multimodalvisionmulti-input reasoning
Google

58.0

Agentic

70.30.058.052.30.0
17

Claude Opus 4

claude-opus-4-20250514

multimodalvisionmulti-input reasoning
Anthropic

57.4

Agentic

35.80.057.447.00.0
18

Nova 2 Pro

nova-2-pro

multimodalvisionmulti-input reasoning
AAmazon

57.2

Agentic

45.30.057.249.60.0N/A
19

GPT-5.6 Luna

gpt-5.6-luna

multimodalvisionmulti-input reasoning
OpenAI

55.0

Agentic

63.994.555.065.537.8$1 in / $6 out
20

Claude Opus 4.7

claude-opus-4-7

multimodalvisionmulti-input reasoning
Anthropic

54.2

Agentic

75.128.354.277.98.0
1

Kimi K3

Moonshot AI

84.2

$3 in / $15 out

2
M

Muse Spark 1.1

Meta

76.6

$1.25 in / $4.25 out

3
B

Seed 2.1 Pro

ByteDance

75.6

N/A

4

Page 1 of 17 · 334 models

Next

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$5 in / $25 out
$3 in / $15 out
N/A
$1.5 in / $9 out
N/A
$2.5 in / $15 out
$3 in / $15 out
N/A
N/A
$5 in / $25 out

Claude Opus 4.8

Anthropic

74.5

$5 in / $25 out

5

GPT-5.6 Sol

OpenAI

71.4

$5 in / $30 out

6

Claude Sonnet 4.5

Anthropic

69.9

$3 in / $15 out

7

GPT-5.5 Pro

OpenAI

69.2

N/A

8

Claude Opus 4.1

Anthropic

67.4

N/A

9

Gemini 3.5 Flash

Google

67.3

$1.5 in / $9 out

10

Claude Mythos Preview

Anthropic

66.6

N/A

11
M

Muse Spark

Meta

64.4

N/A

12
B

Seed 2.1 Turbo

ByteDance

63.1

N/A

13

GPT-5.6 Terra

OpenAI

61.5

$2.5 in / $15 out

14

GPT-5.5

OpenAI

61.0

$5 in / $30 out

15

Claude Sonnet 5

Anthropic

60.7

$3 in / $15 out

16

Gemini 3 Pro

Google

58.0

N/A

17

Claude Opus 4

Anthropic

57.4

N/A

18
A

Nova 2 Pro

Amazon

57.2

N/A

19

GPT-5.6 Luna

OpenAI

55.0

$1 in / $6 out

20

Claude Opus 4.7

Anthropic

54.2

$5 in / $25 out