Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

15.1

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
101

LongCat-Flash-Thinking

longcat-flash-thinking

codeprogrammingtool use
Meituan

18.4

Programming

48.20.00.018.40.0N/A
102

GLM-4.7-Flash

glm-4.7-flash

codeprogrammingtool use
ZZhipu AI

17.7

Programming

36.40.09.017.70.0N/A
103

Gemini 3.5 Flash-Lite

gemini-3.5-flash-lite

multimodalvisionmulti-input reasoning
Google

17.2

Programming

18.984.80.017.259.1
104

Kimi K2-Instruct-0905

kimi-k2-instruct-0905

codeprogrammingtool use
Moonshot AI

17.1

Programming

23.20.06.017.10.0
105

MiniMax M1 80K

minimax-m1-80k

codeprogrammingtool use
MiniMax

16.2

Programming

22.80.020.916.20.0N/A
106

GLM-4.5-Air

glm-4.5-air

codeprogrammingtool use
ZZhipu AI

16.0

Programming

25.70.024.216.00.0N/A
107

MiniMax M1 40K

minimax-m1-40k

codeprogrammingtool use
MiniMax

15.5

Programming

21.30.026.815.50.0N/A
108

Command A+

command-a-plus-05-2026

multimodalvisionmulti-input reasoning
Cohere

15.3

Programming

35.20.00.015.30.0
109

Mercury 2

mercury-2

codeprogrammingtool use
IInception

15.3

Programming

42.768.90.015.384.4$0.25 in / $0.75 out
110

GPT-4.1

gpt-4.1-2025-04-14

multimodalvisionmulti-input reasoning
OpenAI

14.7

Programming

27.273.232.814.740.7
111

Kimi K2 Instruct

kimi-k2-instruct

codeprogrammingtool use
Moonshot AI

14.0

Programming

23.20.013.514.00.0N/A
112

GPT-5 nano

gpt-5-nano-2025-08-07

multimodalvisionmulti-input reasoning
OpenAI

13.3

Programming

25.20.00.013.30.0
113

Devstral Small 1.1

devstral-small-2507

codeprogrammingtool use
Mistral AI

12.5

Programming

0.00.00.012.50.0
114

o3-mini

o3-mini

codeprogrammingtool use
OpenAI

11.6

Programming

25.30.011.911.60.0N/A
115

Claude 3.5 Sonnet

claude-3-5-sonnet-20241022

multimodalvisionmulti-input reasoning
Anthropic

11.1

Programming

32.00.038.711.10.0
116

Sarvam-105B

sarvam-105b

codeprogrammingtool use
SSarvam AI

10.3

Programming

41.10.016.710.30.0N/A
117

DeepSeek-V3

deepseek-v3

codeprogrammingtool use
DeepSeek

8.8

Programming

26.10.00.08.80.0N/A
118

GPT-5.4 nano

gpt-5.4-nano

multimodalvisionmulti-input reasoning
OpenAI

8.2

Programming

41.844.56.98.276.8$0.2 in / $1.25 out
119

o1-preview

o1-preview

codeprogrammingtool use
OpenAI

8.1

Programming

40.20.00.08.10.0N/A
120

Claude 3.5 Haiku

claude-3-5-haiku-20241022

codeprogrammingtool use
Anthropic

6.6

Programming

9.90.03.06.60.0
101

LongCat-Flash-Thinking

Meituan

18.4

N/A

102
Z

GLM-4.7-Flash

Zhipu AI

17.7

N/A

103

Gemini 3.5 Flash-Lite

Google

17.2

$0.3 in / $2.5 out

104

Page 6 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.3 in / $2.5 out
N/A
N/A
$2 in / $8 out
N/A
N/A
N/A
N/A

Kimi K2-Instruct-0905

Moonshot AI

17.1

N/A

105

MiniMax M1 80K

MiniMax

16.2

N/A

106
Z

GLM-4.5-Air

Zhipu AI

16.0

N/A

107

MiniMax M1 40K

MiniMax

15.5

N/A

108

Command A+

Cohere

15.3

N/A

109
I

Mercury 2

Inception

15.3

$0.25 in / $0.75 out

110

GPT-4.1

OpenAI

14.7

$2 in / $8 out

111

Kimi K2 Instruct

Moonshot AI

14.0

N/A

112

GPT-5 nano

OpenAI

13.3

N/A

113

Devstral Small 1.1

Mistral AI

12.5

N/A

114

o3-mini

OpenAI

11.6

N/A

115

Claude 3.5 Sonnet

Anthropic

11.1

N/A

116
S

Sarvam-105B

Sarvam AI

10.3

N/A

117

DeepSeek-V3

DeepSeek

8.8

N/A

118

GPT-5.4 nano

OpenAI

8.2

$0.2 in / $1.25 out

119

o1-preview

OpenAI

8.1

N/A

120

Claude 3.5 Haiku

Anthropic

6.6

N/A