# Compare AI Models

> Pick two of 412 models and compare them side by side across 111 benchmarks, updated with every release. Every valid model pair is indexable and enters the sitemap automatically when a model is added.

## How It Works

1. Pick two models you want to compare.
2. Open the corresponding `/compare/[slug]` page.
3. Review the quick verdict, category winners, benchmark swings, pricing, and related comparisons.

## Popular Comparisons

- [Claude Fable 5.1 vs GPT-6 Astra](/compare/claude-fable-5-1-vs-gpt-6-astra) ([md](/md/compare/claude-fable-5-1-vs-gpt-6-astra.md)) - 84.36 vs 84.11
- [GPT-6 Astra vs GPT-5.6 Sol](/compare/gpt-5-6-sol-vs-gpt-6-astra) ([md](/md/compare/gpt-5-6-sol-vs-gpt-6-astra.md)) - 84.11 vs 80.54
- [Claude Fable 5.1 vs Claude Opus 5](/compare/claude-fable-5-1-vs-claude-opus-5) ([md](/md/compare/claude-fable-5-1-vs-claude-opus-5.md)) - 84.36 vs 81.63
- [GPT-6 Astra vs Claude Opus 5](/compare/claude-opus-5-vs-gpt-6-astra) ([md](/md/compare/claude-opus-5-vs-gpt-6-astra.md)) - 84.11 vs 81.63
- [Claude Fable 5.1 vs Claude Fable 5](/compare/claude-fable-vs-claude-fable-5-1) ([md](/md/compare/claude-fable-vs-claude-fable-5-1.md)) - 84.36 vs 81.31
- [Gemini 3.8 Flash vs GPT-6 Astra](/compare/gemini-3-8-flash-vs-gpt-6-astra) ([md](/md/compare/gemini-3-8-flash-vs-gpt-6-astra.md)) - 77.81 vs 84.11
- [Gemini 3.8 Flash vs Gemini 3.7 Flash](/compare/gemini-3-7-flash-vs-gemini-3-8-flash) ([md](/md/compare/gemini-3-7-flash-vs-gemini-3-8-flash.md)) - 77.81 vs 68.47
- [Grok 4.6 vs GPT-5.6 Sol](/compare/gpt-5-6-sol-vs-grok-4-6) ([md](/md/compare/gpt-5-6-sol-vs-grok-4-6.md)) - 70.03 vs 80.54
- [GLM-5.3 vs Kimi K3](/compare/glm-5-3-vs-kimi-k3) ([md](/md/compare/glm-5-3-vs-kimi-k3.md)) - 68.34 vs 74.75
- [Claude Opus 5 vs GPT-5.6 Sol](/compare/claude-opus-5-vs-gpt-5-6-sol) ([md](/md/compare/claude-opus-5-vs-gpt-5-6-sol.md)) - 81.63 vs 80.54
- [GPT-5.6 Sol vs Claude Sonnet 5](/compare/claude-sonnet-5-vs-gpt-5-6-sol) ([md](/md/compare/claude-sonnet-5-vs-gpt-5-6-sol.md)) - 80.54 vs 69.8
- [Kimi K3 vs GPT-5.6 Sol](/compare/gpt-5-6-sol-vs-kimi-k3) ([md](/md/compare/gpt-5-6-sol-vs-kimi-k3.md)) - 74.75 vs 80.54
- [GPT-5.6 Sol vs Claude Opus 4.8](/compare/claude-opus-4-8-vs-gpt-5-6-sol) ([md](/md/compare/claude-opus-4-8-vs-gpt-5-6-sol.md)) - 80.54 vs 72.16
- [GPT-5.6 Terra vs Gemini 3.5 Flash](/compare/gemini-3-5-flash-vs-gpt-5-6-terra) ([md](/md/compare/gemini-3-5-flash-vs-gpt-5-6-terra.md)) - 71.19 vs 68.12
- [GPT-5.6 Luna vs Gemini 3.5 Flash](/compare/gemini-3-5-flash-vs-gpt-5-6-luna) ([md](/md/compare/gemini-3-5-flash-vs-gpt-5-6-luna.md)) - 64.71 vs 68.12
- [Gemini 3.7 Flash vs Gemini 3.6 Flash](/compare/gemini-3-6-flash-vs-gemini-3-7-flash) ([md](/md/compare/gemini-3-6-flash-vs-gemini-3-7-flash.md)) - 68.47 vs 68.37
- [Gemini 3.6 Flash vs Gemini 3.5 Flash](/compare/gemini-3-5-flash-vs-gemini-3-6-flash) ([md](/md/compare/gemini-3-5-flash-vs-gemini-3-6-flash.md)) - 68.37 vs 68.12
- [Gemini 3.5 Flash-Lite vs Gemini 3.1 Flash-Lite](/compare/gemini-3-1-flash-lite-vs-gemini-3-5-flash-lite) ([md](/md/compare/gemini-3-1-flash-lite-vs-gemini-3-5-flash-lite.md)) - 59 vs 56.23
- [Claude Sonnet 5 vs Claude Opus 4.8](/compare/claude-opus-4-8-vs-claude-sonnet-5) ([md](/md/compare/claude-opus-4-8-vs-claude-sonnet-5.md)) - 69.8 vs 72.16
- [Claude Opus 4.8 vs GPT-5.5](/compare/claude-opus-4-8-vs-gpt-5-5) ([md](/md/compare/claude-opus-4-8-vs-gpt-5-5.md)) - 72.16 vs 72.01
- [Claude Opus 4.8 vs Claude Opus 4.7 (Adaptive)](/compare/claude-opus-4-7-adaptive-vs-claude-opus-4-8) ([md](/md/compare/claude-opus-4-7-adaptive-vs-claude-opus-4-8.md)) - 72.16 vs 69.1
- [Gemini 3.5 Flash vs GPT-5.5](/compare/gemini-3-5-flash-vs-gpt-5-5) ([md](/md/compare/gemini-3-5-flash-vs-gpt-5-5.md)) - 68.12 vs 72.01
- [Gemini 3.5 Flash vs Claude Opus 4.7](/compare/claude-opus-4-7-vs-gemini-3-5-flash) ([md](/md/compare/claude-opus-4-7-vs-gemini-3-5-flash.md)) - 68.12 vs 70.32
- [Gemini 3.5 Flash vs Gemini 3.1 Pro](/compare/gemini-3-1-pro-vs-gemini-3-5-flash) ([md](/md/compare/gemini-3-1-pro-vs-gemini-3-5-flash.md)) - 68.12 vs 69.99
- [GPT-5.5 vs Claude Opus 4.7](/compare/claude-opus-4-7-vs-gpt-5-5) ([md](/md/compare/claude-opus-4-7-vs-gpt-5-5.md)) - 72.01 vs 70.32
- [GPT-5.5 vs Claude Opus 4.7 (Adaptive)](/compare/claude-opus-4-7-adaptive-vs-gpt-5-5) ([md](/md/compare/claude-opus-4-7-adaptive-vs-gpt-5-5.md)) - 72.01 vs 69.1
- [GPT-5.5 vs Claude Fable 5](/compare/claude-fable-vs-gpt-5-5) ([md](/md/compare/claude-fable-vs-gpt-5-5.md)) - 72.01 vs 81.31
- [GPT-5.5 vs Claude Mythos 5](/compare/claude-mythos-5-vs-gpt-5-5) ([md](/md/compare/claude-mythos-5-vs-gpt-5-5.md)) - 72.01 vs 85
- [GPT-5.5 vs Gemini 3.1 Pro](/compare/gemini-3-1-pro-vs-gpt-5-5) ([md](/md/compare/gemini-3-1-pro-vs-gpt-5-5.md)) - 72.01 vs 69.99
- [GPT-5.5 vs Gemini 3.1 Flash-Lite](/compare/gemini-3-1-flash-lite-vs-gpt-5-5) ([md](/md/compare/gemini-3-1-flash-lite-vs-gpt-5-5.md)) - 72.01 vs 56.23
- [GPT-5.5 vs GLM-5.2](/compare/glm-5-2-vs-gpt-5-5) ([md](/md/compare/glm-5-2-vs-gpt-5-5.md)) - 72.01 vs 68.09
- [GPT-5.5 vs GLM-5.1](/compare/glm-5-1-vs-gpt-5-5) ([md](/md/compare/glm-5-1-vs-gpt-5-5.md)) - 72.01 vs 63.49
- [GPT-5.5 vs Kimi K2.7 Code](/compare/gpt-5-5-vs-kimi-k2-7-code) ([md](/md/compare/gpt-5-5-vs-kimi-k2-7-code.md)) - 72.01 vs 65.52
- [GPT-5.5 Pro vs Claude Opus 4.7](/compare/claude-opus-4-7-vs-gpt-5-5-pro) ([md](/md/compare/claude-opus-4-7-vs-gpt-5-5-pro.md)) - 61.85 vs 70.32
- [Claude Opus 4.7 vs Gemini 3.1 Pro](/compare/claude-opus-4-7-vs-gemini-3-1-pro) ([md](/md/compare/claude-opus-4-7-vs-gemini-3-1-pro.md)) - 70.32 vs 69.99
- [GLM-5 (Reasoning) vs GPT-5.5](/compare/glm-5-reasoning-vs-gpt-5-5) ([md](/md/compare/glm-5-reasoning-vs-gpt-5-5.md)) - 57.94 vs 72.01
- [GLM-5.2 vs Kimi K2.7 Code](/compare/glm-5-2-vs-kimi-k2-7-code) ([md](/md/compare/glm-5-2-vs-kimi-k2-7-code.md)) - 68.09 vs 65.52
- [GLM-5.1 vs Kimi K2.7 Code](/compare/glm-5-1-vs-kimi-k2-7-code) ([md](/md/compare/glm-5-1-vs-kimi-k2-7-code.md)) - 63.49 vs 65.52
- [Ling 2.6 Flash vs Kimi K2.7 Code](/compare/kimi-k2-7-code-vs-ling-2-6-flash) ([md](/md/compare/kimi-k2-7-code-vs-ling-2-6-flash.md)) - 40.82 vs 65.52
- [Ling 2.6 Flash vs GPT-5.5](/compare/gpt-5-5-vs-ling-2-6-flash) ([md](/md/compare/gpt-5-5-vs-ling-2-6-flash.md)) - 40.82 vs 72.01
- [Ling 2.6 Flash vs GLM-5.1](/compare/glm-5-1-vs-ling-2-6-flash) ([md](/md/compare/glm-5-1-vs-ling-2-6-flash.md)) - 40.82 vs 63.49
- [Ling 2.6 Flash vs Claude Opus 4.7](/compare/claude-opus-4-7-vs-ling-2-6-flash) ([md](/md/compare/claude-opus-4-7-vs-ling-2-6-flash.md)) - 40.82 vs 70.32
- [Qwen3.6-27B vs Qwen3.6-35B-A3B](/compare/qwen3-6-27b-vs-qwen3-6-35b-a3b) ([md](/md/compare/qwen3-6-27b-vs-qwen3-6-35b-a3b.md)) - 47.79 vs 46.2
- [Qwen3.6-27B vs Qwen3.5-27B](/compare/qwen3-5-27b-vs-qwen3-6-27b) ([md](/md/compare/qwen3-5-27b-vs-qwen3-6-27b.md)) - 47.79 vs 55.3
- [Qwen3.6-27B vs Gemma 4 31B](/compare/gemma-4-31b-vs-qwen3-6-27b) ([md](/md/compare/gemma-4-31b-vs-qwen3-6-27b.md)) - 47.79 vs 52.56
- [Claude Mythos 5 vs GPT-5.5 Pro](/compare/claude-mythos-5-vs-gpt-5-5-pro) ([md](/md/compare/claude-mythos-5-vs-gpt-5-5-pro.md)) - 85 vs 61.85
- [Claude Mythos 5 vs Claude Opus 4.7](/compare/claude-mythos-5-vs-claude-opus-4-7) ([md](/md/compare/claude-mythos-5-vs-claude-opus-4-7.md)) - 85 vs 70.32
- [Claude Fable 5 vs Claude Opus 4.8](/compare/claude-fable-vs-claude-opus-4-8) ([md](/md/compare/claude-fable-vs-claude-opus-4-8.md)) - 81.31 vs 72.16
- [Claude 3.5 Sonnet vs Grok 4](/compare/claude-3-5-sonnet-vs-grok-4) ([md](/md/compare/claude-3-5-sonnet-vs-grok-4.md)) - 32.01 vs 53.39
- [GPT-4o vs Grok 4.1](/compare/gpt-4o-vs-grok-4-1) ([md](/md/compare/gpt-4o-vs-grok-4-1.md)) - 38.96 vs 58.12
- [Gemini 2.5 Pro vs o3](/compare/gemini-2-5-pro-vs-o3) ([md](/md/compare/gemini-2-5-pro-vs-o3.md)) - 57.15 vs 47.57
- [Kimi K2.7 Code vs Kimi K2.6](/compare/kimi-2-6-vs-kimi-k2-7-code) ([md](/md/compare/kimi-2-6-vs-kimi-k2-7-code.md)) - 65.52 vs 65.42
- [Claude Opus 4.7 vs Grok 4.20](/compare/claude-opus-4-7-vs-grok-4-20-beta) ([md](/md/compare/claude-opus-4-7-vs-grok-4-20-beta.md)) - 70.32 vs 67.17
- [GPT-4o vs Grok 4](/compare/gpt-4o-vs-grok-4) ([md](/md/compare/gpt-4o-vs-grok-4.md)) - 38.96 vs 53.39
- [Claude 4.1 Opus Thinking vs Grok 4](/compare/claude-4-1-opus-thinking-vs-grok-4) ([md](/md/compare/claude-4-1-opus-thinking-vs-grok-4.md)) - 31.6 vs 53.39
- [Claude Opus 4.7 vs Grok 4.1 Fast](/compare/claude-opus-4-7-vs-grok-4-1-fast) ([md](/md/compare/claude-opus-4-7-vs-grok-4-1-fast.md)) - 70.32 vs 47.29
- [Gemini 3.1 Pro vs Grok 3 [Beta]](/compare/gemini-3-1-pro-vs-grok-3-beta) ([md](/md/compare/gemini-3-1-pro-vs-grok-3-beta.md)) - 69.99 vs 51.75
- [Claude 4 Sonnet vs Grok 4](/compare/claude-4-sonnet-vs-grok-4) ([md](/md/compare/claude-4-sonnet-vs-grok-4.md)) - 39.43 vs 53.39
- [Claude Opus 4.7 vs GPT-4o](/compare/claude-opus-4-7-vs-gpt-4o) ([md](/md/compare/claude-opus-4-7-vs-gpt-4o.md)) - 70.32 vs 38.96

## AI model comparison FAQ

### How do I compare two AI models?

Pick any two models above to see them side-by-side across 111 benchmarks, plus pricing, speed and context window. Popular pairs are linked below the picker.

### What is the best AI model comparison tool?

BenchLM compares 412 models across 111 sourced benchmarks, updated with every release — every score links to its original source.

### Can I compare ChatGPT, Claude and Gemini?

Yes — any pair, e.g. Claude Opus 5 vs GPT-5.6. For the three-way breakdown see ChatGPT vs Claude vs Gemini.

### How often is the comparison data updated?

On every model release and benchmark ingest; see latest model releases.

## Top Models Available to Compare

| Model | Creator | Overall Score |
|-------|---------|---------------|
| [Claude Fable 5.1](/models/claude-fable-5-1) | Anthropic | 84.36 |
| [GPT-6 Astra](/models/gpt-6-astra) | OpenAI | 84.11 |
| [Claude Opus 5](/models/claude-opus-5) | Anthropic | 81.63 |
| [Claude Fable 5](/models/claude-fable) | Anthropic | 81.31 |
| [GPT-5.6 Sol](/models/gpt-5-6-sol) | OpenAI | 80.54 |
| [Gemini 3.8 Flash](/models/gemini-3-8-flash) | Google | 77.81 |
| [Kimi K3](/models/kimi-k3) | Moonshot AI | 74.75 |
| [Claude Opus 4.8](/models/claude-opus-4-8) | Anthropic | 72.16 |
| [GPT-5.5](/models/gpt-5-5) | OpenAI | 72.01 |
| [Qwen3.8 Max](/models/qwen3-8-max) | Alibaba | 71.6 |
| [GPT-5.6 Terra](/models/gpt-5-6-terra) | OpenAI | 71.19 |
| [GPT-5.4](/models/gpt-5-4) | OpenAI | 70.82 |
| [Muse Spark 1.2](/models/muse-spark-1-2) | Meta | 70.48 |
| [Muse Spark 1.1](/models/muse-spark-1-1) | Meta | 70.38 |
| [Claude Opus 4.7](/models/claude-opus-4-7) | Anthropic | 70.32 |
| [Grok 4.6](/models/grok-4-6) | xAI | 70.03 |
| [Gemini 3.1 Pro](/models/gemini-3-1-pro) | Google | 69.99 |
| [Claude Sonnet 5](/models/claude-sonnet-5) | Anthropic | 69.8 |
| [Claude Opus 4.7 (Adaptive)](/models/claude-opus-4-7-adaptive) | Anthropic | 69.1 |
| [Claude Opus 4.6](/models/claude-opus-4-6) | Anthropic | 69 |
| [GPT-5.2 Pro](/models/gpt-5-2-pro) | OpenAI | 68.83 |
| [Gemini 3.7 Flash](/models/gemini-3-7-flash) | Google | 68.47 |
| [Gemini 3.6 Flash](/models/gemini-3-6-flash) | Google | 68.37 |
| [GLM-5.3](/models/glm-5-3) | Z.AI | 68.34 |
| [Gemini 3.5 Flash](/models/gemini-3-5-flash) | Google | 68.12 |

Canonical page: https://benchlm.ai/compare
