Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

13.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
1

GPT-5.5

gpt-5.5

multimodalvisionmulti-input reasoning
OpenAI

94.5

Inference

76.794.561.051.23.7$5 in / $30 out
2

GPT-5.6 Luna

gpt-5.6-luna

multimodalvisionmulti-input reasoning
OpenAI

94.5

Inference

63.994.555.065.537.8
3

GPT-5.6 Sol

gpt-5.6-sol

multimodalvisionmulti-input reasoning
OpenAI

94.5

Inference

79.894.571.473.73.7
4

GPT-5.6 Terra

gpt-5.6-terra

multimodalvisionmulti-input reasoning
OpenAI

94.5

Inference

74.694.561.569.617.1
5

GPT-4.1 nano

gpt-4.1-nano-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

87.8

Inference

11.687.80.00.094.9
6

DeepSeek-V4-Flash-Max

deepseek-v4-flash-max

codeprogrammingtool use
DeepSeek

84.8

Inference

56.284.835.341.498.8
7

DeepSeek-V4-Pro-Max

deepseek-v4-pro-max

codeprogrammingtool use
DeepSeek

84.8

Inference

64.984.851.052.045.1
8

Gemini 3.5 Flash

gemini-3.5-flash

multimodalvisionmulti-input reasoning
Google

84.8

Inference

60.284.867.321.831.7
9

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite

multimodalvisionmulti-input reasoning
Google

84.8

Inference

18.984.80.017.259.1
10

Gemini 3.6 Flash

gemini-3.6-flash

multimodalvisionmulti-input reasoning
Google

84.8

Inference

57.884.80.052.634.8
11

GLM-5.2

glm-5.2

codeprogrammingtool use
ZZhipu AI

84.8

Inference

68.784.844.159.951.2$0.95 in / $3 out
12

Kimi K3

kimi-k3

multimodalvisionmulti-input reasoning
Moonshot AI

84.8

Inference

76.184.884.20.012.2$3 in / $15 out
13

MiMo-V2.5

mimo-v2.5

multimodalvisionmulti-input reasoning
Xiaomi

84.8

Inference

47.784.80.027.292.7$0.168 in / $0.336 out
14

MiMo-V2.5-Pro

mimo-v2.5-pro

codeprogrammingtool use
Xiaomi

84.8

Inference

36.284.80.056.378.0$0.435 in / $0.87 out
15

Muse Spark 1.1

muse-spark-1.1

multimodalvisionmulti-input reasoning
MMeta

84.8

Inference

69.784.876.658.141.5$1.25 in / $4.25 out
16

GPT-4.1 mini

gpt-4.1-mini-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

84.6

Inference

19.284.68.92.269.5
17

GPT-5 mini

gpt-5-mini-2025-08-07

multimodalvisionmulti-input reasoning
OpenAI

77.4

Inference

39.477.40.022.268.5
18

GPT-4.1

gpt-4.1-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

73.2

Inference

27.273.232.814.740.7
19

LongCat-Flash-Lite

longcat-flash-lite

codeprogrammingtool use
Meituan

72.8

Inference

22.872.830.123.995.6$0.1 in / $0.4 out
20

Mercury 2

mercury-2

codeprogrammingtool use
IInception

68.9

Inference

42.768.90.015.384.4$0.25 in / $0.75 out
1

GPT-5.5

OpenAI

94.5

$5 in / $30 out

2

GPT-5.6 Luna

OpenAI

94.5

$1 in / $6 out

3

GPT-5.6 Sol

OpenAI

94.5

$5 in / $30 out

4

Page 1 of 17 · 334 models

Next

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$1 in / $6 out
$5 in / $30 out
$2.5 in / $15 out
$0.1 in / $0.4 out
$0.1 in / $0.2 out
$1.6 in / $3.2 out
$1.5 in / $9 out
$0.3 in / $2.5 out
$1.5 in / $7.5 out
$0.4 in / $1.6 out
$0.25 in / $2 out
$2 in / $8 out

GPT-5.6 Terra

OpenAI

94.5

$2.5 in / $15 out

5

GPT-4.1 nano

OpenAI

87.8

$0.1 in / $0.4 out

6

DeepSeek-V4-Flash-Max

DeepSeek

84.8

$0.1 in / $0.2 out

7

DeepSeek-V4-Pro-Max

DeepSeek

84.8

$1.6 in / $3.2 out

8

Gemini 3.5 Flash

Google

84.8

$1.5 in / $9 out

9

Gemini 3.5 Flash-Lite

Google

84.8

$0.3 in / $2.5 out

10

Gemini 3.6 Flash

Google

84.8

$1.5 in / $7.5 out

11
Z

GLM-5.2

Zhipu AI

84.8

$0.95 in / $3 out

12

Kimi K3

Moonshot AI

84.8

$3 in / $15 out

13

MiMo-V2.5

Xiaomi

84.8

$0.168 in / $0.336 out

14

MiMo-V2.5-Pro

Xiaomi

84.8

$0.435 in / $0.87 out

15
M

Muse Spark 1.1

Meta

84.8

$1.25 in / $4.25 out

16

GPT-4.1 mini

OpenAI

84.6

$0.4 in / $1.6 out

17

GPT-5 mini

OpenAI

77.4

$0.25 in / $2 out

18

GPT-4.1

OpenAI

73.2

$2 in / $8 out

19

LongCat-Flash-Lite

Meituan

72.8

$0.1 in / $0.4 out

20
I

Mercury 2

Inception

68.9

$0.25 in / $0.75 out