Skytells
HomeModelsCLIChangelog
  • Home
  • Models
  • CLI
  • Changelog
Skytells

Addressing the world's greatest challenges with AI. Enterprise research, foundation models, and infrastructure trusted by organizations worldwide since 2012.

Get Started

  • Console
  • Learn
  • Documentation
  • API Reference
  • Pricing
  • ModelsNew

Platform

  • Cloud AgentsNew
  • AI Solutions
  • Infrastructure
  • Edge Network
  • Trust Center
  • CLI

Resources

  • Blog
  • Changelog
  • AI Leaderboard
  • Research
  • Status

Company

  • About
  • Careers
  • Legal
  • Privacy Policy

© 2012–2026 Skytells, Inc. All rights reserved.

Live rankings

AI Model Leaderboard

Every major AI model ranked across benchmark quality, inference speed, agentic capability, programming aptitude, and cost efficiency — updated continuously from published evaluation data.

Explore full leaderboardBrowse model catalog

334

Tracked models

29

Providers

286

Benchmarked

29.3

Avg. index

OverallBenchmarksInferenceAgenticProgrammingValue / Price

334 models

RankModelProviderScoreBenchmarksInferenceAgenticProgrammingValuePrice
41

GPT-5.2

gpt-5.2-2025-12-11

multimodalvisionmulti-input reasoning
OpenAI

56.5

overall

70.962.837.066.331.5$1.75 in / $14 out
42

Gemini 3 Flash

gemini-3-flash-preview

multimodalvisionmulti-input reasoning
Google

56.3

overall

68.562.833.261.954.9
43

GPT-5.2 Pro

gpt-5.2-pro-2025-12-11

multimodalvisionmulti-input reasoning
OpenAI

56.0

overall

64.40.046.10.00.0
44

Step-3.5-Flash

step-3.5-flash

codeprogrammingtool use
SStepFun

56.0

overall

62.859.836.548.693.9$0.1 in / $0.4 out
45

GPT-5.1

gpt-5.1-2025-11-13

multimodalvisionmulti-input reasoning
OpenAI

56.0

overall

62.462.80.051.437.3
46

GPT-5.1 Instant

gpt-5.1-instant-2025-11-12

multimodalvisionmulti-input reasoning
OpenAI

56.0

overall

62.462.80.051.437.3
47

Claude Sonnet 5

claude-sonnet-5

multimodalvisionmulti-input reasoning
Anthropic

55.8

overall

67.528.360.775.412.0
48

Hy3

hy3

codeprogrammingtool use
TTencent

55.6

overall

65.90.040.459.20.0N/A
49

MiMo-V2.5

mimo-v2.5

multimodalvisionmulti-input reasoning
Xiaomi

55.5

overall

47.784.80.027.292.7$0.168 in / $0.336 out
50

Gemma 4 31B

gemma-4-31b-it

multimodalvisionmulti-input reasoning
Google

55.4

overall

55.432.90.00.091.5$0.13 in / $0.38 out
51

MiniMax M2.5

minimax-m2.5

codeprogrammingtool use
MiniMax

55.4

overall

0.068.943.650.472.9$0.3 in / $1.2 out
52

MiniMax M3

minimax-m3

multimodalvisionmulti-input reasoning
MiniMax

55.3

overall

49.662.837.568.373.2$0.3 in / $1.2 out
53

GPT-5 Medium

gpt-5-medium-2025-08-07

multimodalvisionmulti-input reasoning
OpenAI

54.6

overall

54.60.00.00.00.0
54

Gemini 3.5 Flash

gemini-3.5-flash

multimodalvisionmulti-input reasoning
Google

54.5

overall

60.284.867.321.831.7
55

Kimi K2.6

kimi-k2.6

texttext-to-textlanguage
Moonshot AI

54.3

overall

63.532.947.269.446.3
56

Qwen3.6 Plus

qwen3.6-plus

multimodalvisionmulti-input reasoning
AAlibaba Cloud / Qwen Team

54.0

overall

66.962.833.652.854.9$0.5 in / $3 out
57

Claude Opus 4.6

claude-opus-4-6

multimodalvisionmulti-input reasoning
Anthropic

53.9

overall

74.628.349.871.58.0
58

Claude Opus 4.5

claude-opus-4-5-20251101

multimodalvisionmulti-input reasoning
Anthropic

53.5

overall

54.50.035.272.20.0
59

ChatGPT-4o Latest

chatgpt-4o-latest

multimodalvisionmulti-input reasoning
OpenAI

53.0

overall

53.00.00.00.00.0
60

GPT-5.1 Medium

gpt-5.1-medium-2025-11-12

multimodalvisionmulti-input reasoning
OpenAI

52.5

overall

64.144.90.00.032.0
41

GPT-5.2

OpenAI

56.5

$1.75 in / $14 out

42

Gemini 3 Flash

Google

56.3

$0.5 in / $3 out

43

GPT-5.2 Pro

OpenAI

56.0

N/A

44

Page 3 of 17 · 334 models

PreviousNext

Want benchmark charts, model comparison, and pricing analytics?

Sign in to access the full interactive leaderboard with deep benchmark breakdowns and model comparison tools.

Open full leaderboard

Rankings are based on multi-dimensional evaluation across benchmark quality, inference efficiency, and cost-per-output. Scores are updated continuously and may differ from individual third-party benchmarks.

$0.5 in / $3 out
N/A
$1.25 in / $10 out
$1.25 in / $10 out
$3 in / $15 out
N/A
$1.5 in / $9 out
$0.75 in / $3.5 out
$5 in / $25 out
N/A
N/A
$1.25 in / $10 out
S

Step-3.5-Flash

StepFun

56.0

$0.1 in / $0.4 out

45

GPT-5.1

OpenAI

56.0

$1.25 in / $10 out

46

GPT-5.1 Instant

OpenAI

56.0

$1.25 in / $10 out

47

Claude Sonnet 5

Anthropic

55.8

$3 in / $15 out

48
T

Hy3

Tencent

55.6

N/A

49

MiMo-V2.5

Xiaomi

55.5

$0.168 in / $0.336 out

50

Gemma 4 31B

Google

55.4

$0.13 in / $0.38 out

51

MiniMax M2.5

MiniMax

55.4

$0.3 in / $1.2 out

52

MiniMax M3

MiniMax

55.3

$0.3 in / $1.2 out

53

GPT-5 Medium

OpenAI

54.6

N/A

54

Gemini 3.5 Flash

Google

54.5

$1.5 in / $9 out

55

Kimi K2.6

Moonshot AI

54.3

$0.75 in / $3.5 out

56
A

Qwen3.6 Plus

Alibaba Cloud / Qwen Team

54.0

$0.5 in / $3 out

57

Claude Opus 4.6

Anthropic

53.9

$5 in / $25 out

58

Claude Opus 4.5

Anthropic

53.5

N/A

59

ChatGPT-4o Latest

OpenAI

53.0

N/A

60

GPT-5.1 Medium

OpenAI

52.5

$1.25 in / $10 out