Skip to main content

BenchLM recommendation

Best Large Context Window LLMs in 2026

Data verified

As of July 20, 2026, the top model in best large context window llms on the BenchLM leaderboard is Claude Mythos 5 with a score of 83.9.

Last verified: July 20, 2026

AI models with the largest context windows (200K+ tokens), ranked by benchmark performance.

Unless noted otherwise, ranking surfaces on this page use BenchLM's provisional leaderboard lane rather than the stricter sourced-only verified leaderboard.

Bottom line: A large context window means nothing if the model can't actually use it. Claude Fable 5 and Gemini 3.1 Pro both have 1M+ context and the benchmarks to back it up.

Claude Mythos 5 leads this ranking with a score of 83.9, followed by Claude Fable 5 (83.7) and GPT-5.6 Sol (82). The top three are separated by just a few points — any of them would perform well for this use case.

The best open-weight option is MiniMax M3 (ranked #15 with a score of 69.8). Proprietary models hold a clear advantage in this category, though open-weight options may suffice for less demanding use cases.

This ranking is based on provisional overall weighted scores across BenchLM.ai's scoring formula tracked by BenchLM.ai. For detailed model profiles, click any model name below. To compare two specific models head-to-head, use the "vs #" links.

What changed

Claude Fable 5 leads large-context models with 1M+ context and the highest overall score.

Gemini 3.1 Pro 1M context with strong reasoning (97) — best non-reasoning large-context model.

GPT-5.4 1.05M context — largest window among the top 3 overall models.

How to choose

Full Rankings (125 models)

1
Claude Mythos 5
Anthropic·Proprietary·1M+

83.9

BenchAlign v5

2
Claude Fable 5
Anthropic·Proprietary·1M+

83.7

BenchAlign v5

3
GPT-5.6 Sol
OpenAI·Proprietary·1M

82

BenchAlign v5

4
Kimi K3
Moonshot AI·Pending·1.05M

81

BenchAlign v5

5
Claude Opus 4.8
Anthropic·Proprietary·1M

78.3

BenchAlign v5

6
Muse Spark 1.1
Meta·Proprietary·1M

77.4

BenchAlign v5

7
Grok 4.5
xAI·Proprietary·500K

76.7

BenchAlign v5

8
GPT-5.4
OpenAI·Proprietary·1.05M

74.2

BenchAlign v5

9
GPT-5.5
OpenAI·Proprietary·1M

73.5

BenchAlign v5

10
Qwen3.7 Max
Alibaba·Proprietary·1M

72.8

BenchAlign v5

11
GPT-5.6 Terra
OpenAI·Proprietary·1M

72.6

BenchAlign v5

12
Claude Opus 4.7
Anthropic·Proprietary·1M

71.9

BenchAlign v5

13
Muse Spark
Meta·Proprietary·262K

71

BenchAlign v5

14
MiMo-V2.5-Pro
Xiaomi·Proprietary·1M

70.2

BenchAlign v5

15
MiniMax M3
MiniMax·Open Weight·1M

69.8

BenchAlign v5

16
Claude Opus 4.6
Anthropic·Proprietary·1M

68.6

BenchAlign v5

17
MiMo-V2-Pro
Xiaomi·Proprietary·1M

67.8

BenchAlign v5

18
GLM-5.1
Z.AI·Open Weight·203K

67.7

BenchAlign v5

19
Gemini 3 Pro
Google·Proprietary·2M

67.7

BenchAlign v5

20
Inkling
Thinking Machines Lab·Open Weight·1M

67.5

BenchAlign v5

21
Qwen3.7 Plus
Alibaba·Proprietary·1M

67.2

BenchAlign v5

22
GPT-5.6 Luna
OpenAI·Proprietary·1M

67.2

BenchAlign v5

23
GPT-5.2 Pro
OpenAI·Proprietary·400K

67

BenchAlign v5

24
GLM-5-Turbo
Z.AI·Proprietary·200K

66.9

BenchAlign v5

25
GPT-5.4 nano
OpenAI·Proprietary·400K

66.8

BenchAlign v5

26
GPT-5.3 Codex
OpenAI·Proprietary·400K

66.7

BenchAlign v5

27
Claude Opus 4.7 (Adaptive)
Anthropic·Proprietary·1M

66.3

BenchAlign v5

28
GLM-5
Z.AI·Open Weight·200K

66.1

BenchAlign v5

29
Claude Sonnet 5
Anthropic·Proprietary·1M

65.3

BenchAlign v5

30
Qwen3.6 Plus
Alibaba·Proprietary·1M

65.2

BenchAlign v5

31
Grok 4.3
xAI·Proprietary·1M

65.1

BenchAlign v5

32
Claude Sonnet 4.6
Anthropic·Proprietary·200K

65.1

BenchAlign v5

33
Gemini 3.5 Flash
Google·Proprietary·1M

64.8

BenchAlign v5

34
Claude Opus 4.5
Anthropic·Proprietary·200K

64.2

BenchAlign v5

35
Claude Opus 4.6 (Adaptive)
Anthropic·Proprietary·1M

64.2

BenchAlign v5

36
MiniMax M2.7
MiniMax·Open Weight·200K

64.1

BenchAlign v5

37
GLM-5.2
Z.AI·Open Weight·1M

64

BenchAlign v5

38
GPT-5.5 Pro
OpenAI·Proprietary·1M

63.7

BenchAlign v5

39
GLM-5V-Turbo
Z.AI·Proprietary·200K

63.5

BenchAlign v5

40
MiMo-V2-Omni
Xiaomi·Proprietary·262K

63.2

BenchAlign v5

41
Gemini 3 Pro Deep Think
Google·Proprietary·2M

61.3

BenchAlign v5

42
GLM-4.7
Z.AI·Open Weight·200K

61.2

BenchAlign v5

43
Gemma 4 31B
Google·Open Weight·256K

61.1

BenchAlign v5

44
GPT-5.4 Pro
OpenAI·Proprietary·1.05M

60.9

BenchAlign v5

45
Qwen3.5-27B
Alibaba·Open Weight·262K

60.7

BenchAlign v5

46
DeepSeek V4 Pro
DeepSeek·Open Weight·1M

60.7

BenchAlign v5

47
Qwen3.5-122B-A10B
Alibaba·Open Weight·262K

60.6

BenchAlign v5

48
Grok 4.1 Fast (Reasoning)
xAI·Proprietary·2M

60.5

BenchAlign v5

49
Gemini 3 Flash
Google·Proprietary·1M

60.5

BenchAlign v5

50
Grok 4.1
xAI·Proprietary·1M

60

BenchAlign v5

51
GLM-5 (Reasoning)
Z.AI·Open Weight·200K

59.8

BenchAlign v5

52
Qwen 3.6 Max (preview)
Alibaba·Proprietary·256K

59.7

BenchAlign v5

53
Kimi K2.5
Moonshot AI·Open Weight·256K

59.7

BenchAlign v5

54
GPT-5.2-Codex
OpenAI·Proprietary·400K

59.1

BenchAlign v5

55
GPT-5.3 Instant
OpenAI·Proprietary·400K

58.9

BenchAlign v5

56
DeepSeek V4 Flash
DeepSeek·Open Weight·1M

58.9

BenchAlign v5

57
MiMo-V2.5
Xiaomi·Proprietary·1M

58.6

BenchAlign v5

58
GPT-5.2
OpenAI·Proprietary·400K

58.4

BenchAlign v5

59
Gemma 4 26B A4B
Google·Open Weight·256K

58

BenchAlign v5

60
Claude Opus 4.5 Thinking
Anthropic·Proprietary·200K

57.4

BenchAlign v5

61
Gemini 2.5 Pro
Google·Proprietary·1M

57.3

BenchAlign v5

62
Qwen3.5-35B-A3B
Alibaba·Open Weight·262K

57

BenchAlign v5

63
GPT-5.3-Codex-Spark
OpenAI·Proprietary·256K

56.9

BenchAlign v5

64
Kimi K2.6
Moonshot AI·Open Weight·256K

56.8

BenchAlign v5

65
GPT-5.4 mini
OpenAI·Proprietary·400K

56.8

BenchAlign v5

66
Grok 4 Fast (Reasoning)
xAI·Proprietary·2M

56.6

BenchAlign v5

67
Claude Haiku 4.5
Anthropic·Proprietary·200K

56.6

BenchAlign v5

68
Trinity-Large-Preview
Arcee AI·Open Weight·512K

55.9

BenchAlign v5

69
Hy3
Tencent·Open Weight·256K

55.6

BenchAlign v5

70
DeepSeek V4 Pro (High)
DeepSeek·Open Weight·1M

55.5

BenchAlign v5

71
Gemini 3.1 Pro
Google·Proprietary·1M

55.3

BenchAlign v5

72
GLM-4.6
Z.AI·Open Weight·200K

55.1

BenchAlign v5

73
Step 3.5 Flash
StepFun·Open Weight·256K

55.1

BenchAlign v5

74
Kimi K2.7 Code
Moonshot AI·Open Weight·256K

55

BenchAlign v5

75
Grok 4.20
xAI·Proprietary·2M

54.7

BenchAlign v5

76
GPT-5.1-Codex-Max
OpenAI·Proprietary·400K

54.5

BenchAlign v5

77
MiMo-V2-Flash
Xiaomi·Open Weight·256K

54.1

BenchAlign v5

78
DeepSeek V4 Flash (High)
DeepSeek·Open Weight·1M

54

BenchAlign v5

79
Qwen3.6-27B
Alibaba·Open Weight·262K

53.8

BenchAlign v5

80
GPT-5.1
OpenAI·Proprietary·200K

53.7

BenchAlign v5

81
Claude Sonnet 4.5
Anthropic·Proprietary·200K

53.6

BenchAlign v5

82
GPT-5.1-Codex
OpenAI·Proprietary·400K

52.7

BenchAlign v5

83
Trinity-Large-Thinking
Arcee AI·Open Weight·512K

52.3

BenchAlign v5

84
Qwen3.6-35B-A3B
Alibaba·Open Weight·262K

51.5

BenchAlign v5

85
GLM-4.7-Flash
Z.AI·Open Weight·200K

51.3

BenchAlign v5

86
Grok 4.1 Fast
xAI·Proprietary·1M

51.3

BenchAlign v5

87
GPT-4.1
OpenAI·Proprietary·1M

51.1

BenchAlign v5

88
Nemotron 3 Super 120B A12B
NVIDIA·Open Weight·256K

51

BenchAlign v5

89
Step 3.7 Flash
StepFun·Open Weight·256K

50.9

BenchAlign v5

90
Gemini 3.1 Flash-Lite
Google·Proprietary·1M

50.8

BenchAlign v5

91
Seed 1.6
ByteDance·Proprietary·256K

50.2

BenchAlign v5

92
Nemotron 3 Super 100B
NVIDIA·Open Weight·1M

50.1

BenchAlign v5

93
o4-mini (high)
OpenAI·Proprietary·200K

50

BenchAlign v5

94
Qwen2.5-1M
Alibaba·Open Weight·1M

49.9

BenchAlign v5

95
Seed-2.0-Lite
ByteDance·Proprietary·256K

49.8

BenchAlign v5

96
o1-preview
OpenAI·Proprietary·200K

49.1

BenchAlign v5

97
K-Exaone
LG AI Research·Proprietary·256K

48.5

BenchAlign v5

98
o3-pro
OpenAI·Proprietary·200K

48.3

BenchAlign v5

99
Qwen3 Max
Alibaba·Proprietary·1M

48.2

BenchAlign v5

100
o1
OpenAI·Proprietary·200K

48.1

BenchAlign v5

101
Gemini 2.5 Flash
Google·Proprietary·1M

48.1

BenchAlign v5

102
o3
OpenAI·Proprietary·200K

47.9

BenchAlign v5

103
Claude 3.5 Sonnet
Anthropic·Proprietary·200K

47.7

BenchAlign v5

104
Qwen3.5 Flash
Alibaba·Proprietary·1M

47.7

BenchAlign v5

105
o3-mini
OpenAI·Proprietary·200K

47.4

BenchAlign v5

106
Gemma 4 12B
Google·Open Weight·256K

47.3

BenchAlign v5

107
Qwen3.5 Plus
Alibaba·Proprietary·1M

47.2

BenchAlign v5

108
GPT-5 nano
OpenAI·Proprietary·400K

46.4

BenchAlign v5

109
Mistral Small 4
Mistral·Open Weight·256K

46.2

BenchAlign v5

110
o1-pro
OpenAI·Proprietary·200K

45.9

BenchAlign v5

111
Claude 4.1 Opus
Anthropic·Proprietary·200K

45.9

BenchAlign v5

112
Seed 1.6 Flash
ByteDance·Proprietary·256K

45.1

BenchAlign v5

113
Seed-2.0-Mini
ByteDance·Proprietary·256K

44.6

BenchAlign v5

114
Nemotron 3 Nano Omni 30B A3B
NVIDIA·Open Weight·256K

44.2

BenchAlign v5

115
GPT-4.1 mini
OpenAI·Proprietary·1M

44.2

BenchAlign v5

116
Ling 2.6 Flash
InclusionAI·Open Weight·262K

43.9

BenchAlign v5

117
Claude 4 Sonnet
Anthropic·Proprietary·200K

42.8

BenchAlign v5

118
GPT-4.1 nano
OpenAI·Proprietary·1M

42.1

BenchAlign v5

119
Claude 3 Opus
Anthropic·Proprietary·200K

41.1

BenchAlign v5

120
Llama 4 Scout
Meta·Open Weight·10M

39.9

BenchAlign v5

121
Grok Code Fast 1
xAI·Proprietary·256K

38.6

BenchAlign v5

122
Claude 4.1 Opus Thinking
Anthropic·Proprietary·200K

36.6

BenchAlign v5

123
Gemini 1.5 Pro
Google·Proprietary·2M

35.7

BenchAlign v5

124
Llama 4 Maverick
Meta·Open Weight·1M

23.5

BenchAlign v5

125
Claude 3 Haiku
Anthropic·Proprietary·200K

21.4

BenchAlign v5

Key Takeaways

The top model is Claude Mythos 5 by Anthropic with a BenchAlign v5 score of 83.9 and Supported evidence.

The best open-weight model is MiniMax M3 at position #15.

125 models are included in this ranking.

Score in Context

What these scores mean

Models are filtered by context window (200K+ tokens) and ranked by overall BenchLM score. A large context window alone is not enough — check long-context benchmark scores for actual retrieval and reasoning quality.

Known limitations

Context window size is self-reported by providers. Actual usable context may be smaller due to edge degradation. Long-context benchmarks test specific patterns — real workloads may differ.

Last updated: July 20, 2026

Choose a model with this week’s evidence

Join 2,000+ readers for ranking moves, pricing changes, and the claims that still need proof.

One email each week. Unsubscribe anytime.