Skip to main content
Radar

Keep up with the models you depend on. Follow price changes, retirements, and API updates.Follow the models you depend on.

Follow model changes

Compare AI Models

412 models · 111 benchmarks

Pick two candidates and inspect one aligned evidence record. Scores, pricing, coverage, and decision notes stay side by side.

Step 1: Pick Model AStep 2: Pick Model B

Popular Comparisons

Claude Fable 5.1vsGPT-6 Astra

84.36 vs 84.11

GPT-6 AstravsGPT-5.6 Sol

84.11 vs 80.54

Claude Fable 5.1vsClaude Opus 5

84.36 vs 81.63

GPT-6 AstravsClaude Opus 5

84.11 vs 81.63

Claude Fable 5.1vsClaude Fable 5

84.36 vs 81.31

Gemini 3.8 FlashvsGPT-6 Astra

77.81 vs 84.11

Gemini 3.8 FlashvsGemini 3.7 Flash

77.81 vs 68.47

Grok 4.6vsGPT-5.6 Sol

70.03 vs 80.54

GLM-5.3vsKimi K3

68.34 vs 74.75

Claude Opus 5vsGPT-5.6 Sol

81.63 vs 80.54

GPT-5.6 SolvsClaude Sonnet 5

80.54 vs 69.8

Kimi K3vsGPT-5.6 Sol

74.75 vs 80.54

GPT-5.6 SolvsClaude Opus 4.8

80.54 vs 72.16

GPT-5.6 TerravsGemini 3.5 Flash

71.19 vs 68.12

GPT-5.6 LunavsGemini 3.5 Flash

64.71 vs 68.12

Gemini 3.7 FlashvsGemini 3.6 Flash

68.47 vs 68.37

Gemini 3.6 FlashvsGemini 3.5 Flash

68.37 vs 68.12

Gemini 3.5 Flash-LitevsGemini 3.1 Flash-Lite

59 vs 56.23

Claude Sonnet 5vsClaude Opus 4.8

69.8 vs 72.16

Claude Opus 4.8vsGPT-5.5

72.16 vs 72.01

Claude Opus 4.8vsClaude Opus 4.7 (Adaptive)

72.16 vs 69.1

Gemini 3.5 FlashvsGPT-5.5

68.12 vs 72.01

Gemini 3.5 FlashvsClaude Opus 4.7

68.12 vs 70.32

Gemini 3.5 FlashvsGemini 3.1 Pro

68.12 vs 69.99

GPT-5.5vsClaude Opus 4.7

72.01 vs 70.32

GPT-5.5vsClaude Opus 4.7 (Adaptive)

72.01 vs 69.1

GPT-5.5vsClaude Fable 5

72.01 vs 81.31

GPT-5.5vsClaude Mythos 5

72.01 vs

GPT-5.5vsGemini 3.1 Pro

72.01 vs 69.99

GPT-5.5vsGemini 3.1 Flash-Lite

72.01 vs 56.23

GPT-5.5vsGLM-5.2

72.01 vs 68.09

GPT-5.5vsGLM-5.1

72.01 vs 63.49

GPT-5.5vsKimi K2.7 Code

72.01 vs 65.52

GPT-5.5 ProvsClaude Opus 4.7

61.85 vs 70.32

Claude Opus 4.7vsGemini 3.1 Pro

70.32 vs 69.99

GLM-5 (Reasoning)vsGPT-5.5

57.94 vs 72.01

GLM-5.2vsKimi K2.7 Code

68.09 vs 65.52

GLM-5.1vsKimi K2.7 Code

63.49 vs 65.52

Ling 2.6 FlashvsKimi K2.7 Code

40.82 vs 65.52

Ling 2.6 FlashvsGPT-5.5

40.82 vs 72.01

Ling 2.6 FlashvsGLM-5.1

40.82 vs 63.49

Ling 2.6 FlashvsClaude Opus 4.7

40.82 vs 70.32

Qwen3.6-27BvsQwen3.6-35B-A3B

47.79 vs 46.2

Qwen3.6-27BvsQwen3.5-27B

47.79 vs 55.3

Qwen3.6-27BvsGemma 4 31B

47.79 vs 52.56

Claude Mythos 5vsGPT-5.5 Pro

vs 61.85

Claude Mythos 5vsClaude Opus 4.7

vs 70.32

Claude Fable 5vsClaude Opus 4.8

81.31 vs 72.16

Claude 3.5 SonnetvsGrok 4

32.01 vs 53.39

GPT-4ovsGrok 4.1

38.96 vs 58.12

Gemini 2.5 Provso3

57.15 vs 47.57

Kimi K2.7 CodevsKimi K2.6

65.52 vs 65.42

Claude Opus 4.7vsGrok 4.20

70.32 vs 67.17

GPT-4ovsGrok 4

38.96 vs 53.39

Claude 4.1 Opus ThinkingvsGrok 4

31.6 vs 53.39

Claude Opus 4.7vsGrok 4.1 Fast

70.32 vs 47.29

Gemini 3.1 ProvsGrok 3 [Beta]

69.99 vs 51.75

Claude 4 SonnetvsGrok 4

39.43 vs 53.39

Claude Opus 4.7vsGPT-4o

70.32 vs 38.96

AI model comparison FAQ

How do I compare two AI models?

Pick any two models above to see them side-by-side across 111 benchmarks, plus pricing, speed and context window. Popular pairs are linked below the picker.

What is the best AI model comparison tool?

BenchLM compares 412 models across 111 sourced benchmarks, updated with every release — every score links to its original source.

Can I compare ChatGPT, Claude and Gemini?

Yes — any pair, e.g. Claude Opus 5 vs GPT-5.6. For the three-way breakdown see ChatGPT vs Claude vs Gemini.

How often is the comparison data updated?

On every model release and benchmark ingest; see latest model releases.