Skip to main content
BenchLM
Recommendation

Best Proprietary LLMs in 2026

As of September 29, 2026, the top model in best proprietary llms on the BenchLM leaderboard is GPT-6 Astra with a score of 88.2.

Bottom line: the live table above sets the proprietary order. Near the top, choice often comes down to pricing, latency, access, and API ecosystem, so check each row's evidence label and price before treating the rank as a decision.

Ranking data as of

Full Rankings (114 models)

1
GPT-6 Astra
OpenAI·Proprietary·1.05M

88.2

BenchAlign v5.7

2
Claude Opus 5.5
Anthropic·Proprietary·1M

86.9

BenchAlign v5.7

3
Claude Fable 5.1
Anthropic·Proprietary·1M

82.5

BenchAlign v5.7

4
Claude Sonnet 5.5
Anthropic·Proprietary·1M

80.9

BenchAlign v5.7

5
Claude Opus 5
Anthropic·Proprietary·

79.2

BenchAlign v5.7

6
Claude Fable 5
Anthropic·Proprietary·1M+

78.6

BenchAlign v5.7

7
GPT-6 Sol
OpenAI·Proprietary·1.05M

78.6

BenchAlign v5.7

8
GPT-5.6 Sol
OpenAI·Proprietary·1.05M

78.2

BenchAlign v5.7

9
Gemini 3.8 Flash
Google·Proprietary·1M

73.3

BenchAlign v5.7

10
GPT-5.6 Terra
OpenAI·Proprietary·1.05M

72.4

BenchAlign v5.7

11
GPT-5.5 Pro
OpenAI·Proprietary·1M

72.2

BenchAlign v5.7

12
GPT-5.4 Pro
OpenAI·Proprietary·1.05M

70.7

BenchAlign v5.7

13
Claude Opus 4.8
Anthropic·Proprietary·1M

70.2

BenchAlign v5.7

14
Grok 4.6
xAI·Proprietary·500K

68.8

BenchAlign v5.7

15
GPT-5.5
OpenAI·Proprietary·1M

68.8

BenchAlign v5.7

16
Claude Opus 4.7 (Adaptive)
Anthropic·Proprietary·1M

68.5

BenchAlign v5.7

17
GPT-5.4
OpenAI·Proprietary·1.05M

68.2

BenchAlign v5.7

18
Gemini 3.7 Flash
Google·Proprietary·1M

67.3

BenchAlign v5.7

19
GPT-6.1 Sol
OpenAI·Proprietary·1.05M

66.9

BenchAlign v5.7

20
GPT-5.2 Pro
OpenAI·Proprietary·400K

66.7

BenchAlign v5.7

21
Claude Sonnet 5
Anthropic·Proprietary·1M

66.7

BenchAlign v5.7

22
Claude Opus 4.7
Anthropic·Proprietary·1M

66.3

BenchAlign v5.7

23
GPT-6 Luna
OpenAI·Proprietary·1.05M

66.1

BenchAlign v5.7

24
Muse Spark 1.1
Meta·Proprietary·1M

65.8

BenchAlign v5.7

25
GPT-5.6 Luna
OpenAI·Proprietary·1.05M

65.4

BenchAlign v5.7

26
Grok 4.5
xAI·Proprietary·500K

64.9

BenchAlign v5.7

27
Muse Spark 1.2
Meta·Proprietary·1M

64.6

BenchAlign v5.7

28
Gemini 3.1 Pro
Google·Proprietary·1M

64.4

BenchAlign v5.7

29
Gemini 3.6 Flash
Google·Proprietary·1M

64.4

BenchAlign v5.7

30
Claude Opus 4.6
Anthropic·Proprietary·1M

63.5

BenchAlign v5.7

31
Gemini 3.5 Flash
Google·Proprietary·1M

63.2

BenchAlign v5.7

32
Qwen3.7 Max
Alibaba·Proprietary·1M

63.2

BenchAlign v5.7

33
GPT-5.3 Codex
OpenAI·Proprietary·400K

61.8

BenchAlign v5.7

34
GPT-5.2
OpenAI·Proprietary·400K

61.2

BenchAlign v5.7

35
Gemini 3 Pro
Google·Proprietary·2M

60.8

BenchAlign v5.7

36
Muse Spark
Meta·Proprietary·262K

60.6

BenchAlign v5.7

37
Grok 4.20
xAI·Proprietary·2M

59.7

BenchAlign v5.7

38
GPT-5.1
OpenAI·Proprietary·200K

58.2

BenchAlign v5.7

39
Claude Sonnet 4.6
Anthropic·Proprietary·200K

56.1

BenchAlign v5.7

40
Qwen3.7 Plus
Alibaba·Proprietary·1M

55.7

BenchAlign v5.7

41
Gemini 3 Flash
Google·Proprietary·1M

55.5

BenchAlign v5.7

42
Qwen 3.6 Max (preview)
Alibaba·Proprietary·256K

55

BenchAlign v5.7

43
Claude Opus 4.5
Anthropic·Proprietary·200K

54.9

BenchAlign v5.7

44
GPT-5.4 mini
OpenAI·Proprietary·400K

54.9

BenchAlign v5.7

45
Claude Opus 4.5 Thinking
Anthropic·Proprietary·200K

54.7

BenchAlign v5.7

46
Grok 4.3
xAI·Proprietary·1M

54.6

BenchAlign v5.7

47
Qwen3.6 Plus
Alibaba·Proprietary·1M

54.4

BenchAlign v5.7

48
Grok 4
xAI·Proprietary·128K

52.6

BenchAlign v5.7

49
GLM-5-Turbo
Z.AI·Proprietary·200K

52.4

BenchAlign v5.7

50
MiMo-V2-Pro
Xiaomi·Proprietary·1M

52.2

BenchAlign v5.7

51
MiMo-V2.5-Pro
Xiaomi·Proprietary·1M

51.8

BenchAlign v5.7

52
Gemini 3.5 Flash-Lite
Google·Proprietary·1M

50.9

BenchAlign v5.7

53
GPT-5.4 nano
OpenAI·Proprietary·400K

50.7

BenchAlign v5.7

54
Gemini 2.5 Pro
Google·Proprietary·1M

50.2

BenchAlign v5.7

55
Gemini 3.1 Flash-Lite
Google·Proprietary·1M

50

BenchAlign v5.7

56
GPT-5.2-Codex
OpenAI·Proprietary·400K

49.9

BenchAlign v5.7

57
MiniMax M2.5
MiniMax·Proprietary·128K

49.7

BenchAlign v5.7

58
MiMo-V2-Omni
Xiaomi·Proprietary·262K

49

BenchAlign v5.7

59
Qwen3.5 Plus
Alibaba·Proprietary·1M

48.9

BenchAlign v5.7

60
GLM-5V-Turbo
Z.AI·Proprietary·200K

48.6

BenchAlign v5.7

61
Claude Sonnet 4.5
Anthropic·Proprietary·200K

47.9

BenchAlign v5.7

62
Qwen3.7 Flash
Alibaba·Proprietary·1M

47.5

BenchAlign v5.7

63
o3-pro
OpenAI·Proprietary·200K

47.1

BenchAlign v5.7

64
o3
OpenAI·Proprietary·200K

47

BenchAlign v5.7

65
Quasar 438B
Multiverse Computing·Proprietary·1M

46.1

BenchAlign v5.7

66
Apodex 1.1
Apodex·Proprietary·N/A

45.9

BenchAlign v5.7

67
Qwen3.5 Flash
Alibaba·Proprietary·1M

45.5

BenchAlign v5.7

68
Grok 4.1 Fast (Reasoning)
xAI·Proprietary·2M

45.4

BenchAlign v5.7

69
Grok 3 [Beta]
xAI·Proprietary·128K

45.1

BenchAlign v5.7

70
GPT-5 (medium)
OpenAI·Proprietary·128K

44.6

BenchAlign v5.7

71
GPT-5.1-Codex
OpenAI·Proprietary·400K

44.4

BenchAlign v5.7

72
GPT-5 mini
OpenAI·Proprietary·128K

44

BenchAlign v5.7

73
Grok 3 Mini
xAI·Proprietary·128K

43.8

BenchAlign v5.7

74
Gemini 2.5 Flash
Google·Proprietary·1M

43

BenchAlign v5.7

75
Claude Haiku 4.5
Anthropic·Proprietary·200K

42.5

BenchAlign v5.7

76
Grok 4 Fast (Reasoning)
xAI·Proprietary·2M

42.2

BenchAlign v5.7

77
o3-mini
OpenAI·Proprietary·200K

40.1

BenchAlign v5.7

78
GPT-4.1
OpenAI·Proprietary·1M

39.7

BenchAlign v5.7

79
Qwen3 Max
Alibaba·Proprietary·1M

39

BenchAlign v5.7

80
Claude 4.1 Opus
Anthropic·Proprietary·200K

38.3

BenchAlign v5.7

81
o1
OpenAI·Proprietary·200K

37.5

BenchAlign v5.7

82
K-Exaone
LG AI Research·Proprietary·256K

37.1

BenchAlign v5.7

83
Claude 4.1 Opus Thinking
Anthropic·Proprietary·200K

36.4

BenchAlign v5.7

84
o1-preview
OpenAI·Proprietary·200K

36.3

BenchAlign v5.7

85
Grok 4.1 Fast
xAI·Proprietary·1M

36.3

BenchAlign v5.7

86
Claude 4 Sonnet
Anthropic·Proprietary·200K

35.9

BenchAlign v5.7

87
o1-pro
OpenAI·Proprietary·200K

35.7

BenchAlign v5.7

88
GPT-5 nano
OpenAI·Proprietary·400K

35

BenchAlign v5.7

89
GLM-4.5-Air
Z.AI·Proprietary·128K

34.6

BenchAlign v5.7

90
Mercury 2.5
Inception·Proprietary·260K

34.3

BenchAlign v5.7

91
Mercury 2
Inception·Proprietary·128K

34.2

BenchAlign v5.7

92
Mistral Large 3
Mistral·Proprietary·128K

34.1

BenchAlign v5.7

93
Solar Pro 3
Upstage·Proprietary·128K

32.4

BenchAlign v5.7

94
Grok Code Fast 1
xAI·Proprietary·256K

31.9

BenchAlign v5.7

95
Solar Pro 2
Upstage·Proprietary·128K

31.8

BenchAlign v5.7

96
Celeris-1
Celeris·Proprietary·128K

31.4

BenchAlign v5.7

97
GPT-4o
OpenAI·Proprietary·128K

30.7

BenchAlign v5.7

98
Claude 3.5 Sonnet
Anthropic·Proprietary·200K

30

BenchAlign v5.7

99
GPT-4.1 mini
OpenAI·Proprietary·1M

29.1

BenchAlign v5.7

100
Mistral Large 2
Mistral·Proprietary·128K

29

BenchAlign v5.7

101
Claude 3 Opus
Anthropic·Proprietary·200K

28.6

BenchAlign v5.7

102
Mistral Medium 3
Mistral·Proprietary·128K

28.3

BenchAlign v5.7

103
Gemini 1.5 Pro
Google·Proprietary·2M

27.9

BenchAlign v5.7

104
GPT-4o mini
OpenAI·Proprietary·128K

26.9

BenchAlign v5.7

105
Kimi K2
Moonshot AI·Proprietary·128K

26.3

BenchAlign v5.7

106
GPT-4.1 nano
OpenAI·Proprietary·1M

24.9

BenchAlign v5.7

107
MiniMax M1 80k
MiniMax·Proprietary·80K

24.8

BenchAlign v5.7

108
GPT-4 Turbo
OpenAI·Proprietary·128K

21.6

BenchAlign v5.7

109
Nova Pro
Amazon·Proprietary·128K

20.8

BenchAlign v5.7

110
LFM2-24B-A2B
LiquidAI·Proprietary·32K

19.9

BenchAlign v5.7

111
LFM2.5-1.2B-Thinking
LiquidAI·Proprietary·32K

18.7

BenchAlign v5.7

112
LFM2.5-1.2B-Instruct
LiquidAI·Proprietary·32K

18.3

BenchAlign v5.7

113
Claude 3 Haiku
Anthropic·Proprietary·200K

14.8

BenchAlign v5.7

114
Gemini 1.0 Pro
Google·Proprietary·32K

13

BenchAlign v5.7

How to choose

Key Takeaways

The top model is GPT-6 Astra by OpenAI with a BenchAlign v5.7 score of 88.2 and Supported evidence.

114 models are included in this ranking.

Score in Context

What these scores mean

Models are ranked by the same overall BenchLM score used across all leaderboards. Comparing within proprietary's lineup helps identify which model fits your use case and budget.

Known limitations

This page only shows proprietary models. Cross-provider comparison requires the overall or category-specific leaderboards. Newer models may have limited benchmark coverage initially.

About this ranking

Ranking data as of September 29, 2026

Top proprietary/closed-source AI models ranked by benchmark performance.

Unless noted otherwise, ranking surfaces on this page use BenchLM’s provisional leaderboard lane rather than the stricter sourced-only verified leaderboard.

GPT-6 Astra leads this ranking with a score of 88.2, followed by Claude Opus 5.5 (86.9) and Claude Fable 5.1 (82.5). There is meaningful separation between the top models, suggesting genuine performance differences.

All models in this ranking are proprietary. No open-weight alternatives are available for this category.

This ranking uses provisional overall weighted scores from the active scoring formula. For detailed model profiles, click any model name above. To compare two specific models head-to-head, use the "vs #" links.

Explore More

Last updated: September 29, 2026

Know when it’s worth switching models

The model to choose, the cheaper alternative, and the release we would wait on.

Read a sample issue

Join 2,000+ readers.

One email each week. Unsubscribe anytime.