Skip to main content
Radar

Five or fewer confirmed AI changes, with original sources, on mornings when something changed.A free source-linked morning brief.

See the free Radar Brief
BenchLM recommendation

Best Reasoning AI Models in 2026

Data verified

Claude Fable 5.1 leads reasoning ai models on the September 2026 ranking with a score of 82.6, ahead of Claude Fable 5 (82.2) and Claude Opus 5 (82.1). Each row uses the public BenchAlign v5 contract and shows its evidence status.

Bottom line: Reasoning models (chain-of-thought) dominate the top of the leaderboard. Claude Fable 5 leads, but they cost more and are slower. Choose reasoning when accuracy matters more than speed.

About this ranking

Last verified: September 3, 2026

Top AI models with dedicated reasoning capabilities, ranked by benchmark performance.

Unless noted otherwise, ranking surfaces on this page use BenchLM’s provisional leaderboard lane rather than the stricter sourced-only verified leaderboard.

Claude Fable 5.1 leads this ranking with a score of 82.6, followed by Claude Fable 5 (82.2) and Claude Opus 5 (82.1). The top three are separated by just a few points — any of them would perform well for this use case.

The best open-weight option is Hy4 preview (ranked #7 with a score of 78.5). While proprietary models lead, open-weight options are within striking distance for teams willing to trade a few points of performance for full model control.

This ranking uses provisional overall weighted scores from the active scoring formula. For detailed model profiles, click any model name below. To compare two specific models head-to-head, use the "vs #" links.

What changed

Claude Fable 5 leads all reasoning models with the highest overall score.

GPT-5.4 best OpenAI reasoning model — leads knowledge at 98.

GPT-5.4 Pro premium tier with perfect multimodal and math scores.

How to choose

Full Rankings (141 models)

1
Claude Fable 5.1
Anthropic·Proprietary·1M

82.6

BenchAlign v5

2
Claude Fable 5
Anthropic·Proprietary·1M+

82.2

BenchAlign v5

3
Claude Opus 5
Anthropic·Proprietary·

82.1

BenchAlign v5

4
GPT-6 Astra
OpenAI·Proprietary·1.05M

81.9

BenchAlign v5

5
GPT-5.6 Sol
OpenAI·Proprietary·1.05M

81.8

BenchAlign v5

6
Kimi K3
Moonshot AI·Pending·1.05M

79.7

BenchAlign v5

7
Hy4 preview
Tencent·Open Weight·1M

78.5

BenchAlign v5

8
Qwen3.8 Max
Alibaba·Open Weight·1M

78.3

BenchAlign v5

9
Muse Spark 1.2
Meta·Proprietary·1M

76.6

BenchAlign v5

10
Muse Spark 1.1
Meta·Proprietary·1M

76.5

BenchAlign v5

11
Claude Opus 4.8
Anthropic·Proprietary·1M

75.8

BenchAlign v5

12
Gemini 3.8 Flash
Google·Proprietary·1M

75.1

BenchAlign v5

13
Gemini 3.7 Flash
Google·Proprietary·1M

75

BenchAlign v5

14
Gemini 3.6 Flash
Google·Proprietary·1M

74.9

BenchAlign v5

15
Grok 4.6
xAI·Proprietary·500K

74.8

BenchAlign v5

16
Grok 4.5
xAI·Proprietary·500K

74.7

BenchAlign v5

17
GPT-5.5
OpenAI·Proprietary·1M

73

BenchAlign v5

18
GPT-5.4
OpenAI·Proprietary·1.05M

72.9

BenchAlign v5

19
GPT-5.6 Terra
OpenAI·Proprietary·1.05M

72.5

BenchAlign v5

20
Qwen3.8-27B
Alibaba·Open Weight·262K

71.7

BenchAlign v5

21
Claude Opus 4.7 (Adaptive)
Anthropic·Proprietary·1M

71.6

BenchAlign v5

22
Qwen3.7 Max
Alibaba·Proprietary·1M

71.2

BenchAlign v5

23
Muse Spark
Meta·Proprietary·262K

70.8

BenchAlign v5

24
MiMo-V2.5-Pro
Xiaomi·Proprietary·1M

68.9

BenchAlign v5

25
dots3-note Preview
Dots Studio·Open Weight·512K

68.7

BenchAlign v5

26
GPT-5.2 Pro
OpenAI·Proprietary·400K

67.6

BenchAlign v5

27
Hy3
Tencent·Open Weight·256K

67.6

BenchAlign v5

28
Ornith-1.5-397B
Ornith AI·Open Weight·262K

67.3

BenchAlign v5

29
GLM-5.3
Z.AI·Open Weight·1M

67.1

BenchAlign v5

30
GLM-5.2
Z.AI·Open Weight·1M

67

BenchAlign v5

31
GLM-5.1
Z.AI·Open Weight·203K

66.9

BenchAlign v5

32
GPT-5.4 nano
OpenAI·Proprietary·400K

66.6

BenchAlign v5

33
MiMo-V2-Pro
Xiaomi·Proprietary·1M

66.6

BenchAlign v5

34
GLM-5-Turbo
Z.AI·Proprietary·200K

65.8

BenchAlign v5

35
GPT-5.6 Luna
OpenAI·Proprietary·1.05M

65.7

BenchAlign v5

36
GPT-5.3 Codex
OpenAI·Proprietary·400K

65.5

BenchAlign v5

37
Claude Opus 4.6 (Adaptive)
Anthropic·Proprietary·1M

65.4

BenchAlign v5

38
Qwen3.7 Plus
Alibaba·Proprietary·1M

65.4

BenchAlign v5

39
Gemini 3.5 Flash-Lite
Google·Proprietary·1M

65

BenchAlign v5

40
Qwen3.6 Plus
Alibaba·Proprietary·1M

64.9

BenchAlign v5

41
Claude Sonnet 5
Anthropic·Proprietary·1M

64.8

BenchAlign v5

42
GPT-5.5 Pro
OpenAI·Proprietary·1M

64.7

BenchAlign v5

43
Gemini 3.5 Flash
Google·Proprietary·1M

64.2

BenchAlign v5

44
Grok 4.3
xAI·Proprietary·1M

63.9

BenchAlign v5

45
Gemini 3 Pro Deep Think
Google·Proprietary·2M

62.5

BenchAlign v5

46
MiMo-V2.5
Xiaomi·Proprietary·1M

62.2

BenchAlign v5

47
MiMo-V2-Omni
Xiaomi·Proprietary·262K

62.1

BenchAlign v5

48
GLM-5.3-Flash
Z.AI·Open Weight·1M

61.9

BenchAlign v5

49
GPT-5.4 Pro
OpenAI·Proprietary·1.05M

61.7

BenchAlign v5

50
DeepSeek V4 Pro 0813
DeepSeek·Proprietary·1M

61.3

BenchAlign v5

51
Grok 4.20
xAI·Proprietary·2M

61.2

BenchAlign v5

52
Agents-A1
InternScience·Open Weight·262K

61.1

BenchAlign v5

53
Agents-A1-F16-GGUF
InternScience·Open Weight·262K

61.1

BenchAlign v5

54
Agents-A1-FP8
InternScience·Open Weight·262K

61.1

BenchAlign v5

55
Agents-A1-Q4_K_M-GGUF
InternScience·Open Weight·262K

61.1

BenchAlign v5

56
Agents-A1-Q8_0-GGUF
InternScience·Open Weight·262K

61.1

BenchAlign v5

57
Qwen 3.6 Max (preview)
Alibaba·Proprietary·256K

60.9

BenchAlign v5

58
GLM-5 (Reasoning)
Z.AI·Open Weight·200K

60.9

BenchAlign v5

59
GLM-4.7
Z.AI·Open Weight·200K

60.9

BenchAlign v5

60
Qwen3.8-Flash-Next
Alibaba·Open Weight·262K

60.8

BenchAlign v5

61
Qwen3.5 397B (Reasoning)
Alibaba·Open Weight·128K

60.6

BenchAlign v5

62
Kimi K2.5 (Reasoning)
Moonshot AI·Proprietary·128K

60.5

BenchAlign v5

63
Gemma 4 31B
Google·Open Weight·256K

60.2

BenchAlign v5

64
GPT-5.2 Instant
OpenAI·Proprietary·128K

60.1

BenchAlign v5

65
GPT-5.3 Instant
OpenAI·Proprietary·400K

60

BenchAlign v5

66
GPT-5 (high)
OpenAI·Proprietary·128K

59.8

BenchAlign v5

67
Qwen3.5-27B
Alibaba·Open Weight·262K

59.7

BenchAlign v5

68
Grok 4.1 Fast (Reasoning)
xAI·Proprietary·2M

59.6

BenchAlign v5

69
Qwen3.5-122B-A10B
Alibaba·Open Weight·262K

59.5

BenchAlign v5

70
DeepSeek V3.2 (Thinking)
DeepSeek·Open Weight·128K

59.3

BenchAlign v5

71
Qwen3 235B 2507 (Reasoning)
Alibaba·Open Weight·128K

59.1

BenchAlign v5

72
Kimi K2.7 Code
Moonshot AI·Open Weight·256K

59

BenchAlign v5

73
Kimi K2.6
Moonshot AI·Open Weight·256K

58.9

BenchAlign v5

74
GPT-5.2
OpenAI·Proprietary·400K

58

BenchAlign v5

75
GPT-5.3-Codex-Spark
OpenAI·Proprietary·256K

58

BenchAlign v5

76
GPT-5.2-Codex
OpenAI·Proprietary·400K

57.8

BenchAlign v5

77
Claude Opus 4.5 Thinking
Anthropic·Proprietary·200K

57.3

BenchAlign v5

78
Gemma 4 26B A4B
Google·Open Weight·256K

57.2

BenchAlign v5

79
GPT-5.4 mini
OpenAI·Proprietary·400K

56.8

BenchAlign v5

80
Gemini 3.1 Pro
Google·Proprietary·1M

56.5

BenchAlign v5

81
Qwen3.5-35B-A3B
Alibaba·Open Weight·262K

56.1

BenchAlign v5

82
Apodex 1.1
Apodex·Proprietary·N/A

56.1

BenchAlign v5

83
Grok 4 Fast (Reasoning)
xAI·Proprietary·2M

55.8

BenchAlign v5

84
GPT-5.1-Codex-Max
OpenAI·Proprietary·400K

55.5

BenchAlign v5

85
GLM-4.6
Z.AI·Open Weight·200K

54.5

BenchAlign v5

86
Step 3.7 Flash
StepFun·Open Weight·256K

54.4

BenchAlign v5

87
GPT-5 (medium)
OpenAI·Proprietary·128K

54.1

BenchAlign v5

88
Ling 3.0 Flash
InclusionAI·Open Weight·262K

53.7

BenchAlign v5

89
Qwen3.6-27B
Alibaba·Open Weight·262K

53.6

BenchAlign v5

90
GPT-5.1
OpenAI·Proprietary·200K

53.4

BenchAlign v5

91
Ornith-1.5-35B-A3B
Ornith AI·Open Weight·262K

53.4

BenchAlign v5

92
MiMo-V2-Flash
Xiaomi·Open Weight·256K

53.4

BenchAlign v5

93
DeepSeek V3.1 (Reasoning)
DeepSeek·Open Weight·128K

52.9

BenchAlign v5

94
GPT-5.1-Codex
OpenAI·Proprietary·400K

52.7

BenchAlign v5

95
Qwen3.6-35B-A3B
Alibaba·Open Weight·262K

51.4

BenchAlign v5

96
Seed 1.6
ByteDance·Proprietary·256K

51.2

BenchAlign v5

97
DeepSeek-R1
DeepSeek·Open Weight·128K

51.1

BenchAlign v5

98
o4-mini (high)
OpenAI·Proprietary·200K

51

BenchAlign v5

99
DeepSeekMath V2
DeepSeek·Open Weight·128K

50.9

BenchAlign v5

100
GLM-4.7-Flash
Z.AI·Open Weight·200K

50.5

BenchAlign v5

101
Ministral 3 14B (Reasoning)
Mistral·Open Weight·128K

50.3

BenchAlign v5

102
Ornith-1.5-9B
Ornith AI·Open Weight·262K

50.3

BenchAlign v5

103
MAI-Thinking-1
Microsoft·Proprietary·256K

50.3

BenchAlign v5

104
o1
OpenAI·Proprietary·200K

48.8

BenchAlign v5

105
o1-preview
OpenAI·Proprietary·200K

48.7

BenchAlign v5

106
Qwen3 Max
Alibaba·Proprietary·1M

48.4

BenchAlign v5

107
Mercury 2
Inception·Proprietary·128K

48.3

BenchAlign v5

108
Trinity-Large-Thinking
Arcee AI·Open Weight·512K

48.1

BenchAlign v5

109
Qwen3.5 Plus
Alibaba·Proprietary·1M

48

BenchAlign v5

110
Qwen3.5 Flash
Alibaba·Proprietary·1M

47.9

BenchAlign v5

111
Command A+
Cohere·Open Weight·128K

47.7

BenchAlign v5

112
K-Exaone
LG AI Research·Proprietary·256K

47.6

BenchAlign v5

113
Gemma 4 12B
Google·Open Weight·256K

47.5

BenchAlign v5

114
o3-pro
OpenAI·Proprietary·200K

47.2

BenchAlign v5

115
o3-mini
OpenAI·Proprietary·200K

46.9

BenchAlign v5

116
o3
OpenAI·Proprietary·200K

46.8

BenchAlign v5

117
GPT-5 nano
OpenAI·Proprietary·400K

46.7

BenchAlign v5

118
o1-pro
OpenAI·Proprietary·200K

46.3

BenchAlign v5

119
Seed 1.6 Flash
ByteDance·Proprietary·256K

46

BenchAlign v5

120
Nemotron 3 Ultra
NVIDIA·Open Weight·1M

45.4

BenchAlign v5

121
Nemotron Ultra 253B
NVIDIA·Open Weight·32K

45.3

BenchAlign v5

122
Nemotron 3 Nano Omni 30B A3B
NVIDIA·Open Weight·256K

44.7

BenchAlign v5

123
Gemma 4 E4B
Google·Open Weight·128K

43.6

BenchAlign v5

124
Sarvam 105B
Sarvam·Open Weight·128K

43.5

BenchAlign v5

125
Hy3 Preview
Tencent·Open Weight·256K

43.4

BenchAlign v5

126
LFM2.5-2.6B
LiquidAI·Open Weight·128K

43.1

BenchAlign v5

127
DeepSeek R1 Distill Qwen 32B
DeepSeek·Open Weight·128K

43.1

BenchAlign v5

128
GPT-5 mini
OpenAI·Proprietary·128K

43

BenchAlign v5

129
Granite 4.2 8B
IBM·Open Weight·128K

42.8

BenchAlign v5

130
Gemma 4 E2B
Google·Open Weight·128K

42.6

BenchAlign v5

131
LFM2.5-8B-A1B
LiquidAI·Open Weight·128K

42

BenchAlign v5

132
Solar Pro 2
Upstage·Proprietary·128K

41.8

BenchAlign v5

133
Sarvam 30B
Sarvam·Open Weight·64K

41.4

BenchAlign v5

134
Ministral 3 8B (Reasoning)
Mistral·Open Weight·128K

41.2

BenchAlign v5

135
Exaone 4.0 32B
LG AI Research·Open Weight·128K

41.1

BenchAlign v5

136
Ministral 3 3B (Reasoning)
Mistral·Open Weight·128K

40.3

BenchAlign v5

137
Claude 4.1 Opus Thinking
Anthropic·Proprietary·200K

35.2

BenchAlign v5

138
ZAYA1-8B
Zyphra·Open Weight·131K

31.1

BenchAlign v5

139

26.2

BenchAlign v5

140
LFM2.5-1.2B-Thinking
LiquidAI·Proprietary·32K

15.9

BenchAlign v5

141
MiniCPM5-1B
OpenBMB·Open Weight·131K

11.5

BenchAlign v5

Key Takeaways

The top model is Claude Fable 5.1 by Anthropic with a BenchAlign v5 score of 82.6 and Estimated evidence.

The best open-weight model is Hy4 preview at position #7.

141 models are included in this ranking.

Score in Context

What these scores mean

Reasoning models use chain-of-thought to improve accuracy on complex tasks. They are ranked by the same overall BenchLM score. Reasoning models typically outperform standard models by 10-20 points on math and logic.

Known limitations

Reasoning models are slower and more expensive per token due to longer output chains. The speed/cost trade-off is not reflected in benchmark scores. For latency-sensitive applications, compare with non-reasoning models.

Last updated: September 3, 2026

Know when it’s worth switching models

The model to choose, the cheaper alternative, and the release we would wait on.

Read a sample issue

Join 2,000+ readers.

One email each week. Unsubscribe anytime.