# Artificial Analysis Intelligence Index

> A display-only intelligence index published by Artificial Analysis that aggregates provider-reported and benchmark-derived signals into a single model-level score.

Canonical page: https://benchlm.ai/benchmarks/artificialanalysis

- Category: [Knowledge](/knowledge)
- Last updated: September 10, 2026

## About Artificial Analysis Intelligence Index

- Year: 2026
- Tasks: Cross-benchmark intelligence index
- Format: Aggregated model score
- Difficulty: Display-only external reference
- Paper: [Artificial Analysis](https://artificialanalysis.ai/)

BenchLM tracks Artificial Analysis as a display-only external reference rather than a weighted benchmark. It is useful as a market snapshot, but it is not a benchmark-native row with a single public task set, scoring harness, or exact-source methodology aligned to BenchLM's core benchmark pages.

Artificial Analysis Intelligence Index is currently displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Leaderboard (185 models)

| Rank | Model | Creator | Score |
|------|-------|---------|-------|
| 1 | [GPT-5.6 Sol](/models/gpt-5-6-sol) | OpenAI | 58.9% |
| 2 | [GPT-5.6 Terra](/models/gpt-5-6-terra) | OpenAI | 55.0% |
| 3 | [Claude Fable 5.1](/models/claude-fable-5-1) | Anthropic | 53.4% |
| 4 | [DeepSeek V4 Pro 0813](/models/deepseek-v4-pro-0813) | DeepSeek | 53.2% |
| 5 | [GPT-6 Astra](/models/gpt-6-astra) | OpenAI | 52.8% |
| 6 | [GPT-5.6 Luna](/models/gpt-5-6-luna) | OpenAI | 51.2% |
| 7 | [Claude Opus 5](/models/claude-opus-5) | Anthropic | 50.7% |
| 8 | [Gemini 3.5 Flash](/models/gemini-3-5-flash) | Google | 50.2% |
| 9 | [Claude Fable 5](/models/claude-fable) | Anthropic | 49.7% |
| 10 | [Muse Spark 1.3](/models/muse-spark-1-3) | Meta | 48.2% |
| 11 | [GLM-5.3](/models/glm-5-3) | Z.AI | 44.9% |
| 12 | [Grok 4.6](/models/grok-4-6) | xAI | 44.4% |
| 13 | [Kimi K3](/models/kimi-k3) | Moonshot AI | 43.8% |
| 14 | [Claude Opus 4.8](/models/claude-opus-4-8) | Anthropic | 42.0% |
| 15 | [GLM-5.3-Flash](/models/glm-5-3-flash) | Z.AI | 41.9% |
| 16 | [Hy3 Preview](/models/hy3-preview) | Tencent | 41.2% |
| 17 | [Gemini 3.8 Flash](/models/gemini-3-8-flash) | Google | 41.2% |
| 18 | [Claude Opus 4.7 (Adaptive)](/models/claude-opus-4-7-adaptive) | Anthropic | 40.7% |
| 19 | [Qwen3.8 Max Preview](/models/qwen3-8-max-preview) | Alibaba | 40.3% |
| 20 | [Qwen3.8-Flash-Next](/models/qwen3-8-flash-next) | Alibaba | 39.9% |
| 21 | [Muse Spark 1.2](/models/muse-spark-1-2) | Meta | 39.8% |
| 22 | [DeepSeek V4.1 Flash](/models/deepseek-v4-1-flash) | DeepSeek | 39.5% |
| 23 | [Gemini 3.7 Flash](/models/gemini-3-7-flash) | Google | 39.4% |
| 24 | [Grok 4.5](/models/grok-4-5) | xAI | 39.1% |
| 25 | [GPT-5.4](/models/gpt-5-4) | OpenAI | 39.0% |
| 26 | [GLM-5.2](/models/glm-5-2) | Z.AI | 38.6% |
| 27 | [GPT-5.5](/models/gpt-5-5) | OpenAI | 38.6% |
| 28 | [Claude Sonnet 5](/models/claude-sonnet-5) | Anthropic | 38.4% |
| 29 | [Grok 4.3](/models/grok-4-3) | xAI | 37.6% |
| 30 | [DeepSeek V4 Flash 0731](/models/deepseek-v4-flash-0731) | DeepSeek | 34.5% |
| 31 | [Gemini 3.6 Flash](/models/gemini-3-6-flash) | Google | 34.3% |
| 32 | [Muse Spark 1.1](/models/muse-spark-1-1) | Meta | 34.3% |
| 33 | [Qwen3.8-27B](/models/qwen3-8-27b) | Alibaba | 33.9% |
| 34 | [GPT-5.3 Codex](/models/gpt-5-3-codex) | OpenAI | 32.5% |
| 35 | [Claude Opus 4.6 (Adaptive)](/models/claude-opus-4-6-thinking) | Anthropic | 31.9% |
| 36 | [Kimi K2.6](/models/kimi-2-6) | Moonshot AI | 31.3% |
| 37 | [Muse Spark](/models/muse-spark) | Meta | 31.3% |
| 38 | [Claude Opus 4.7](/models/claude-opus-4-7) | Anthropic | 30.9% |
| 39 | [GPT-5.2](/models/gpt-5-2) | OpenAI | 30.4% |
| 40 | [Apodex 1.1](/models/apodex-1-1) | Apodex | 30.4% |
| 41 | [Apodex 1.1 Mini](/models/apodex-1-1-mini) | Apodex | 30.4% |
| 42 | [Gemini 3.1 Pro](/models/gemini-3-1-pro) | Google | 30.4% |
| 43 | [Qwen3.7 Max](/models/qwen3-7-max) | Alibaba | 29.9% |
| 44 | [MiniMax M3](/models/minimax-m3) | MiniMax | 29.6% |
| 45 | [Claude Opus 4.5 Thinking](/models/claude-opus-4-5-thinking) | Anthropic | 29.1% |
| 46 | [MiMo-V2-Pro](/models/mimo-v2-pro) | Xiaomi | 28.6% |
| 47 | [GPT-5.2-Codex](/models/gpt-5-2-codex) | OpenAI | 28.5% |
| 48 | [Qwen 3.6 Max (preview)](/models/qwen3-6-max-preview) | Alibaba | 28.4% |
| 49 | [Solar Pro 4](/models/solar-pro-4) | Upstage | 28.1% |
| 50 | [Gemini 3 Pro](/models/gemini-3-pro) | Google | 28.0% |
| 51 | [GLM-5](/models/glm-5) | Z.AI | 27.9% |
| 52 | [Quasar 438B](/models/quasar-438b) | Multiverse Computing | 27.1% |
| 53 | [Qwen3.6 Plus](/models/qwen3-6-plus) | Alibaba | 27.0% |
| 54 | [GLM-5-Turbo](/models/glm-5-turbo) | Z.AI | 26.6% |
| 55 | [GLM-5.1](/models/glm-5-1) | Z.AI | 26.4% |
| 56 | [MiMo-V2.5-Pro](/models/mimo-v2-5-pro) | Xiaomi | 26.4% |
| 57 | [Claude Opus 4.6](/models/claude-opus-4-6) | Anthropic | 26.4% |
| 58 | [Kimi K2.7 Code](/models/kimi-k2-7-code) | Moonshot AI | 26.3% |
| 59 | [Inkling-Small](/models/inkling-small) | Thinking Machines Lab | 26.1% |
| 60 | [Qwen3.7 Plus](/models/qwen3-7-plus) | Alibaba | 25.8% |
| 61 | [Hy3](/models/hy3) | Tencent | 25.8% |
| 62 | [Inkling](/models/inkling) | Thinking Machines Lab | 25.5% |
| 63 | [Ling 3.0 Flash](/models/ling-3-0-flash) | InclusionAI | 24.9% |
| 64 | [Ling 3.0 Flash FP8](/models/ling-3-0-flash-fp8) | InclusionAI | 24.9% |
| 65 | [Ling 3.0 Flash VL](/models/ling-3-0-flash-vl) | InclusionAI | 24.8% |
| 66 | [GPT-5.1](/models/gpt-5-1) | OpenAI | 24.7% |
| 67 | [Claude Sonnet 4.6](/models/claude-sonnet-4-6) | Anthropic | 24.7% |
| 68 | [GPT-5.4 mini](/models/gpt-5-4-mini) | OpenAI | 24.6% |
| 69 | [MiMo-V2-Omni](/models/mimo-v2-omni) | Xiaomi | 23.9% |
| 70 | [GPT-5.1-Codex-Max](/models/gpt-5-1-codex-max) | OpenAI | 23.7% |
| 71 | [GPT-5.1-Codex](/models/gpt-5-1-codex) | OpenAI | 23.7% |
| 72 | [Claude Opus 4.5](/models/claude-opus-4-5) | Anthropic | 23.7% |
| 73 | [GLM-5V-Turbo](/models/glm-5v-turbo) | Z.AI | 23.5% |
| 74 | [Kimi K2.5 (Reasoning)](/models/kimi-k2-5-reasoning) | Moonshot AI | 23.5% |
| 75 | [Kimi K2.5](/models/kimi-k2-5) | Moonshot AI | 23.5% |
| 76 | [Nemotron 3 Ultra](/models/nemotron-3-ultra) | NVIDIA | 23.4% |
| 77 | [MiniMax M2.7](/models/minimax-m2-7) | MiniMax | 23.2% |
| 78 | [GPT-5 (high)](/models/gpt-5-high) | OpenAI | 23.0% |
| 79 | [Qwen3.5-27B](/models/qwen3-5-27b) | Alibaba | 22.9% |
| 80 | [GPT-5 (medium)](/models/gpt-5-medium) | OpenAI | 22.9% |
| 81 | [Claude 4.1 Opus Thinking](/models/claude-4-1-opus-thinking) | Anthropic | 22.9% |
| 82 | [A.X K2](/models/a-x-k2) | SK Telecom | 22.7% |
| 83 | [Gemini 3.5 Flash-Lite](/models/gemini-3-5-flash-lite) | Google | 22.7% |
| 84 | [Command A+](/models/command-a-plus) | Cohere | 22.5% |
| 85 | [Grok 4](/models/grok-4) | xAI | 22.5% |
| 86 | [GLM-4.7](/models/glm-4-7) | Z.AI | 22.2% |
| 87 | [Qwen3.6-27B](/models/qwen3-6-27b) | Alibaba | 21.9% |
| 88 | [o3-pro](/models/o3-pro) | OpenAI | 21.9% |
| 89 | [Qwen3.5 397B (Reasoning)](/models/qwen3-5-397b-reasoning) | Alibaba | 21.4% |
| 90 | [Qwen3.5 397B](/models/qwen3-5-397b) | Alibaba | 21.4% |
| 91 | [GPT-5.4 nano](/models/gpt-5-4-nano) | OpenAI | 21.2% |
| 92 | [Grok 4.1 Fast (Reasoning)](/models/grok-4-1-fast-reasoning) | xAI | 20.4% |
| 93 | [o3](/models/o3) | OpenAI | 20.2% |
| 94 | [K-EXAONE 2.0](/models/k-exaone-2-0) | LG AI Research | 19.7% |
| 95 | [Step 3.7 Flash](/models/step-3-7-flash) | StepFun | 19.5% |
| 96 | [Qwen3.5-35B-A3B](/models/qwen3-5-35b-a3b) | Alibaba | 19.3% |
| 97 | [Qwen3.6-35B-A3B](/models/qwen3-6-35b-a3b) | Alibaba | 18.8% |
| 98 | [Claude 4.1 Opus](/models/claude-4-1-opus) | Anthropic | 18.6% |
| 99 | [Muse Glimmer 30B](/models/muse-glimmer-30b) | Meta | 18.1% |
| 100 | [Grok 4 Fast (Reasoning)](/models/grok-4-fast-reasoning) | xAI | 17.9% |
| 101 | [Gemini 3 Flash](/models/gemini-3-flash) | Google | 17.9% |
| 102 | [Gemma 4 26B A4B](/models/gemma-4-26b-a4b) | Google | 16.7% |
| 103 | [Gemini 2.5 Pro](/models/gemini-2-5-pro) | Google | 16.7% |
| 104 | [Claude 4 Sonnet](/models/claude-4-sonnet) | Anthropic | 16.6% |
| 105 | [Qwen3.5-122B-A10B](/models/qwen3-5-122b-a10b) | Alibaba | 16.2% |
| 106 | [MiMo-V2-Flash](/models/mimo-v2-flash) | Xiaomi | 16.1% |
| 107 | [DeepSeek V3.2](/models/deepseek-v3-2) | DeepSeek | 16.0% |
| 108 | [Qwen3 Max](/models/qwen3-max) | Alibaba | 15.6% |
| 109 | [Gemma 4 31B](/models/gemma-4-31b) | Google | 15.4% |
| 110 | [o1](/models/o1) | OpenAI | 15.2% |
| 111 | [GLM-4.6](/models/glm-4-6) | Z.AI | 14.9% |
| 112 | [Mistral Medium 3.5 128B](/models/mistral-medium-3-5-128b) | Mistral | 14.9% |
| 113 | [Granite 4.2 30B](/models/granite-4-2-30b) | IBM | 14.8% |
| 114 | [K-Exaone](/models/k-exaone) | LG AI Research | 14.4% |
| 115 | [Gemma 4 12B](/models/gemma-4-12b) | Google | 14.2% |
| 116 | [Grok Code Fast 1](/models/grok-code-fast-1) | xAI | 14.1% |
| 117 | [Ling 2.6 Flash](/models/ling-2-6-flash) | InclusionAI | 14.1% |
| 118 | [DeepSeek V3.1](/models/deepseek-v3-1) | DeepSeek | 13.7% |
| 119 | [Nemotron 3.5 Lightning 30B A3B NVFP4](/models/nemotron-3-5-lightning-30b-a3b-nvfp4) | NVIDIA | 13.6% |
| 120 | [Nemotron 3 Super 100B](/models/nemotron-3-super-100b) | NVIDIA | 13.6% |
| 121 | [DeepSeek V3.1 (Reasoning)](/models/deepseek-v3-1-reasoning) | DeepSeek | 13.5% |
| 122 | [MiniCPM5-2B](/models/minicpm5-2b) | OpenBMB | 13.1% |
| 123 | [DeepSeek-R1](/models/deepseek-r1) | DeepSeek | 13.1% |
| 124 | [North Mini Code](/models/north-mini-code-1-0) | Cohere | 12.8% |
| 125 | [Kimi K2](/models/kimi-k2) | Moonshot AI | 12.7% |
| 126 | [GPT-4.1](/models/gpt-4-1) | OpenAI | 12.7% |
| 127 | [o3-mini](/models/o3-mini) | OpenAI | 12.5% |
| 128 | [o1-pro](/models/o1-pro) | OpenAI | 12.4% |
| 129 | [GPT-OSS 120B](/models/gpt-oss-120b) | OpenAI | 12.3% |
| 130 | [Ling 3.0 Tiny](/models/ling-3-0-tiny) | InclusionAI | 11.9% |
| 131 | [Granite 4.2 8B](/models/granite-4-2-8b) | IBM | 11.8% |
| 132 | [Mistral Small 4](/models/mistral-small-4) | Mistral | 11.4% |
| 133 | [Mistral Small 4 (Reasoning)](/models/mistral-small-4-reasoning) | Mistral | 11.4% |
| 134 | [o1-preview](/models/o1-preview) | OpenAI | 11.4% |
| 135 | [Grok 4.1 Fast](/models/grok-4-1-fast) | xAI | 11.3% |
| 136 | [GLM-4.5-Air](/models/glm-4-5-air) | Z.AI | 11.1% |
| 137 | [Trinity-Large-Preview](/models/trinity-large-preview) | Arcee AI | 10.9% |
| 138 | [Trinity-Large-Thinking](/models/trinity-large-thinking) | Arcee AI | 10.9% |
| 139 | [Nemotron 3 Nano Omni 30B A3B](/models/nemotron-3-nano-omni-30b-a3b) | NVIDIA | 10.3% |
| 140 | [GPT-4.1 mini](/models/gpt-4-1-mini) | OpenAI | 10.2% |
| 141 | [Gemini 2.5 Flash](/models/gemini-2-5-flash) | Google | 9.8% |
| 142 | [Mistral Large 3](/models/mistral-large-3) | Mistral | 9.7% |
| 143 | [Llama 4 Maverick](/models/llama-4-maverick) | Meta | 9.3% |
| 144 | [Granite 4.2 3B](/models/granite-4-2-3b) | IBM | 9.1% |
| 145 | [Mistral Medium 3](/models/mistral-medium-3) | Mistral | 9.1% |
| 146 | [GPT-OSS 20B](/models/gpt-oss-20b) | OpenAI | 9.0% |
| 147 | [Gemma 4 E4B](/models/gemma-4-e4b) | Google | 8.9% |
| 148 | [Nemotron 3 Nano 30B](/models/nemotron-3-nano-30b) | NVIDIA | 8.9% |
| 149 | [Sarvam 105B](/models/sarvam-105b) | Sarvam | 8.8% |
| 150 | [Claude 3 Opus](/models/claude-3-opus) | Anthropic | 8.7% |
| 151 | [DeepSeek V3](/models/deepseek-v3) | DeepSeek | 8.5% |
| 152 | [GPT-4o](/models/gpt-4o) | OpenAI | 8.4% |
| 153 | [LFM2.5-2.6B](/models/lfm2-5-2-6b) | LiquidAI | 8.4% |
| 154 | [DeepSeek R1 Distill Qwen 32B](/models/deepseek-r1-distill-qwen-32b) | DeepSeek | 8.4% |
| 155 | [Gemini 1.5 Pro](/models/gemini-1-5-pro) | Google | 7.9% |
| 156 | [GPT-4.1 nano](/models/gpt-4-1-nano) | OpenAI | 7.8% |
| 157 | [Solar Pro 3](/models/solar-pro-3) | Upstage | 7.8% |
| 158 | [Gemma 4 E2B](/models/gemma-4-e2b) | Google | 7.8% |
| 159 | [Qwen3-Omni-30B-A3B-Thinking](/models/qwen3-omni-30b-a3b-thinking) | Alibaba | 7.8% |
| 160 | [Ultravox v0.6 Llama 3.3 70B](/models/ultravox-v0-6-llama-3-3-70b) | Fixie AI | 7.7% |
| 161 | [Mistral Large 2](/models/mistral-large-2) | Mistral | 7.6% |
| 162 | [Nemotron Ultra 253B](/models/nemotron-ultra-253b) | NVIDIA | 7.5% |
| 163 | [Llama 3.1 405B](/models/llama-3-1-405b) | Meta | 7.3% |
| 164 | [LFM2.5-8B-A1B](/models/lfm2-5-8b-a1b) | LiquidAI | 7.2% |
| 165 | [GPT-4 Turbo](/models/gpt-4-turbo) | OpenAI | 7.0% |
| 166 | [Solar Pro 2](/models/solar-pro-2) | Upstage | 7.0% |
| 167 | [Nova Pro](/models/nova-pro) | Amazon | 7.0% |
| 168 | [Qwen2.5 Coder 32B Instruct](/models/qwen2-5-coder-32b-instruct) | Alibaba | 6.7% |
| 169 | [GPT-4o mini](/models/gpt-4o-mini) | OpenAI | 6.7% |
| 170 | [Sarvam 30B](/models/sarvam-30b) | Sarvam | 6.6% |
| 171 | [Llama 4 Scout](/models/llama-4-scout) | Meta | 6.5% |
| 172 | [Celeris-1](/models/celeris-1) | Celeris | 6.3% |
| 173 | [Exaone 4.0 32B](/models/exaone-4-0-32b) | LG AI Research | 6.3% |
| 174 | [Qwen3-Omni-30B-A3B-Instruct](/models/qwen3-omni-30b-a3b-instruct) | Alibaba | 6.0% |
| 175 | [Phi-4](/models/phi-4) | Microsoft | 5.9% |
| 176 | [Phi-4 Multimodal Instruct](/models/phi-4-multimodal-instruct) | Microsoft | 5.8% |
| 177 | [Claude 3 Haiku](/models/claude-3-haiku) | Anthropic | 5.6% |
| 178 | [Gemini 1.0 Pro](/models/gemini-1-0-pro) | Google | 5.3% |
| 179 | [Exaone 4.0 1.2B](/models/exaone-4-0-1-2b) | LG AI Research | 5.2% |
| 180 | [Granite-4.0-H-1B](/models/granite-4-0-h-1b) | IBM | 5.2% |
| 181 | [Granite-4.0-1B](/models/granite-4-0-1b) | IBM | 5.0% |
| 182 | [Gemma 3 27B](/models/gemma-3-27b) | Google | 4.8% |
| 183 | [Granite-4.0-350M](/models/granite-4-0-350m) | IBM | 4.8% |
| 184 | [Granite-4.0-H-350M](/models/granite-4-0-h-350m) | IBM | 4.8% |
| 185 | [LFM2.5-VL-1.6B-Extract](/models/lfm2-5-vl-1-6b-extract) | LiquidAI | 4.8% |

## FAQ

### What does Artificial Analysis Intelligence Index measure?

A display-only intelligence index published by Artificial Analysis that aggregates provider-reported and benchmark-derived signals into a single model-level score.

### Which model scores highest on Artificial Analysis Intelligence Index?

GPT-5.6 Sol by OpenAI currently leads with a score of 58.9% on Artificial Analysis Intelligence Index.

### How many models are evaluated on Artificial Analysis Intelligence Index?

185 AI models have been evaluated on Artificial Analysis Intelligence Index on BenchLM.

### Does Artificial Analysis Intelligence Index affect BenchLM's overall score?

Not directly. Artificial Analysis Intelligence Index is still displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Compare Top Models on Artificial Analysis Intelligence Index

- [GPT-5.6 Sol vs GPT-5.6 Terra](/compare/gpt-5-6-sol-vs-gpt-5-6-terra)
- [GPT-5.6 Terra vs Claude Fable 5.1](/compare/claude-fable-5-1-vs-gpt-5-6-terra)
- [Claude Fable 5.1 vs DeepSeek V4 Pro 0813](/compare/claude-fable-5-1-vs-deepseek-v4-pro-0813)
- [DeepSeek V4 Pro 0813 vs GPT-6 Astra](/compare/deepseek-v4-pro-0813-vs-gpt-6-astra)
