Skip to main content
Radar

Five or fewer confirmed AI changes, with original sources, on mornings when something changed.A free source-linked morning brief.

Start free brief

Compare AI Models

397 models · 109 benchmarks

Pick two candidates and inspect one aligned evidence record. Scores, pricing, coverage, and decision notes stay side by side.

Step 1: Pick Model AStep 2: Pick Model B

Popular Comparisons

Claude Opus 5vsGPT-5.6 Sol

82.94 vs 82.04

GPT-5.6 SolvsClaude Sonnet 5

82.04 vs 64.87

Kimi K3vsGPT-5.6 Sol

80.45 vs 82.04

GPT-5.6 SolvsClaude Opus 4.8

82.04 vs 76.45

GPT-5.6 TerravsGemini 3.5 Flash

72.8 vs 64.6

GPT-5.6 LunavsGemini 3.5 Flash

67.2 vs 64.6

Gemini 3.7 FlashvsGemini 3.6 Flash

61.28 vs 75.5

Gemini 3.6 FlashvsGemini 3.5 Flash

75.5 vs 64.6

Gemini 3.5 Flash-LitevsGemini 3.1 Flash-Lite

65.3 vs 50.78

Claude Sonnet 5vsClaude Opus 4.8

64.87 vs 76.45

Claude Opus 4.8vsGPT-5.5

76.45 vs 72.95

Claude Opus 4.8vsClaude Opus 4.7 (Adaptive)

76.45 vs 72.41

Gemini 3.5 FlashvsGPT-5.5

64.6 vs 72.95

Gemini 3.5 FlashvsClaude Opus 4.7

64.6 vs 72.16

Gemini 3.5 FlashvsGemini 3.1 Pro

64.6 vs 56.14

GPT-5.5vsClaude Opus 4.7

72.95 vs 72.16

GPT-5.5vsClaude Opus 4.7 (Adaptive)

72.95 vs 72.41

GPT-5.5vsClaude Fable 5

72.95 vs 83.01

GPT-5.5vsClaude Mythos 5

72.95 vs 83.26

GPT-5.5vsGemini 3.1 Pro

72.95 vs 56.14

GPT-5.5vsGemini 3.1 Flash-Lite

72.95 vs 50.78

GPT-5.5vsGLM-5.2

72.95 vs 63.26

GPT-5.5vsGLM-5.1

72.95 vs 66.99

GPT-5.5vsKimi K2.7 Code

72.95 vs 54.3

GPT-5.5 ProvsClaude Opus 4.7

64.32 vs 72.16

Claude Opus 4.7vsGemini 3.1 Pro

72.16 vs 56.14

GLM-5 (Reasoning)vsGPT-5.5

60.47 vs 72.95

GLM-5.2vsKimi K2.7 Code

63.26 vs 54.3

GLM-5.1vsKimi K2.7 Code

66.99 vs 54.3

Ling 2.6 FlashvsKimi K2.7 Code

44.16 vs 54.3

Ling 2.6 FlashvsGPT-5.5

44.16 vs 72.95

Ling 2.6 FlashvsGLM-5.1

44.16 vs 66.99

Ling 2.6 FlashvsClaude Opus 4.7

44.16 vs 72.16

Qwen3.6-27BvsQwen3.6-35B-A3B

53.72 vs 51.44

Qwen3.6-27BvsQwen3.5-27B

53.72 vs 59.88

Qwen3.6-27BvsGemma 4 31B

53.72 vs 60.25

Claude Mythos 5vsGPT-5.5 Pro

83.26 vs 64.32

Claude Mythos 5vsClaude Opus 4.7

83.26 vs 72.16

Claude Fable 5vsClaude Opus 4.8

83.01 vs 76.45

Claude 3.5 SonnetvsGrok 4

48.28 vs 59.69

GPT-4ovsGrok 4.1

40.99 vs 60.66

Gemini 2.5 Provso3

56.7 vs 47.06

Kimi K2.7 CodevsKimi K2.6

54.3 vs 60.14

Claude Opus 4.7vsGrok 4.20

72.16 vs 55.34

GPT-4ovsGrok 4

40.99 vs 59.69

Claude 4.1 Opus ThinkingvsGrok 4

35.54 vs 59.69

Claude Opus 4.7vsGrok 4.1 Fast

72.16 vs 50.75

Gemini 3.1 ProvsGrok 3 [Beta]

56.14 vs 40.28

Claude 4 SonnetvsGrok 4

42.27 vs 59.69

Claude Opus 4.7vsGPT-4o

72.16 vs 40.99

AI model comparison FAQ

How do I compare two AI models?

Pick any two models above to see them side-by-side across 109 benchmarks, plus pricing, speed and context window. Popular pairs are linked below the picker.

What is the best AI model comparison tool?

BenchLM compares 397 models across 109 sourced benchmarks, updated with every release — every score links to its original source.

Can I compare ChatGPT, Claude and Gemini?

Yes — any pair, e.g. Claude Opus 5 vs GPT-5.6. For the three-way breakdown see ChatGPT vs Claude vs Gemini.

How often is the comparison data updated?

On every model release and benchmark ingest; see latest model releases.