# Design Arena Website Elo (Design Arena Website)

> A display-only Design Arena website-generation Elo score surfaced on OpenRouter model benchmark pages.

Canonical page: https://benchlm.ai/benchmarks/designarenawebsite

- Category: [Multimodal & Grounded](/multimodal-grounded)
- Last updated: September 27, 2026

## About Design Arena Website

- Year: 2026
- Tasks: Website generation comparisons
- Format: Elo
- Difficulty: Design and website generation
- Paper: [OpenRouter Grok 4.3 benchmarks](https://openrouter.ai/x-ai/grok-4.3/benchmarks)

OpenRouter's Grok 4.3 benchmark page reports Website at 1294 Elo, 56.5% win rate, 166.3s average generation time, and Top 13%. BenchLM stores the Elo as the benchmark value and keeps the supporting fields in the description.

Design Arena Website is currently displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Leaderboard (89 models)

| Rank | Model | Creator | Score |
|------|-------|---------|-------|
| 1 | [Muse Spark 1.3](/models/muse-spark-1-3) | Meta | 1365 |
| 2 | [Kimi K3](/models/kimi-k3) | Moonshot AI | 1351 |
| 3 | [MiMo-V2.6-Pro](/models/mimo-v2-6-pro) | Xiaomi | 1331 |
| 4 | [Claude Fable 5.1](/models/claude-fable-5-1) | Anthropic | 1320 |
| 5 | [Claude Opus 5](/models/claude-opus-5) | Anthropic | 1319 |
| 6 | [Muse Spark 1.2](/models/muse-spark-1-2) | Meta | 1318 |
| 7 | [Gemini 3.7 Flash](/models/gemini-3-7-flash) | Google | 1313 |
| 8 | [GLM-5.3](/models/glm-5-3) | Z.AI | 1312 |
| 9 | [Gemini 3.8 Flash](/models/gemini-3-8-flash) | Google | 1311 |
| 10 | [Gemini 3.6 Flash](/models/gemini-3-6-flash) | Google | 1310 |
| 11 | [Claude Fable 5](/models/claude-fable) | Anthropic | 1307 |
| 12 | [Grok 4.6](/models/grok-4-6) | xAI | 1302 |
| 13 | [Claude Opus 4.6](/models/claude-opus-4-6) | Anthropic | 1302 |
| 14 | [GLM-5.2](/models/glm-5-2) | Z.AI | 1302 |
| 15 | [Claude Opus 4.6 (Adaptive)](/models/claude-opus-4-6-thinking) | Anthropic | 1302 |
| 16 | [Claude Sonnet 4.6](/models/claude-sonnet-4-6) | Anthropic | 1295 |
| 17 | [Grok 4.5](/models/grok-4-5) | xAI | 1294 |
| 18 | [GLM-5.1](/models/glm-5-1) | Z.AI | 1290 |
| 19 | [Claude Sonnet 5](/models/claude-sonnet-5) | Anthropic | 1286 |
| 20 | [Qwen3.7 Max](/models/qwen3-7-max) | Alibaba | 1283 |
| 21 | [GLM-5.3-Flash](/models/glm-5-3-flash) | Z.AI | 1282 |
| 22 | [Kimi K2.6](/models/kimi-2-6) | Moonshot AI | 1281 |
| 23 | [Qwen3.7 Plus](/models/qwen3-7-plus) | Alibaba | 1281 |
| 24 | [MiMo-V2.5-Pro](/models/mimo-v2-5-pro) | Xiaomi | 1281 |
| 25 | [Muse Spark 1.1](/models/muse-spark-1-1) | Meta | 1280 |
| 26 | [Kimi K2.7 Code](/models/kimi-k2-7-code) | Moonshot AI | 1277 |
| 27 | [MiMo-V2.5](/models/mimo-v2-5) | Xiaomi | 1276 |
| 28 | [Gemini 3.5 Flash](/models/gemini-3-5-flash) | Google | 1275 |
| 29 | [GLM-5-Turbo](/models/glm-5-turbo) | Z.AI | 1274 |
| 30 | [MiniMax M3](/models/minimax-m3) | MiniMax | 1269 |
| 31 | [GPT-5.5](/models/gpt-5-5) | OpenAI | 1267 |
| 32 | [Claude Opus 4.8](/models/claude-opus-4-8) | Anthropic | 1266 |
| 33 | [Gemini 3.1 Pro](/models/gemini-3-1-pro) | Google | 1264 |
| 34 | [Kimi K2.5](/models/kimi-k2-5) | Moonshot AI | 1260 |
| 35 | [Kimi K2.5 (Reasoning)](/models/kimi-k2-5-reasoning) | Moonshot AI | 1260 |
| 36 | [GLM-5](/models/glm-5) | Z.AI | 1259 |
| 37 | [GLM-5 (Reasoning)](/models/glm-5-reasoning) | Z.AI | 1259 |
| 38 | [DeepSeek V4 Pro 0813](/models/deepseek-v4-pro-0813) | DeepSeek | 1258 |
| 39 | [Claude Opus 4.5](/models/claude-opus-4-5) | Anthropic | 1258 |
| 40 | [Claude Opus 4.5 Thinking](/models/claude-opus-4-5-thinking) | Anthropic | 1258 |
| 41 | [MiniMax M2.7](/models/minimax-m2-7) | MiniMax | 1254 |
| 42 | [Qwen3.6 Plus](/models/qwen3-6-plus) | Alibaba | 1251 |
| 43 | [GLM-5V-Turbo](/models/glm-5v-turbo) | Z.AI | 1241 |
| 44 | [Grok 4.20](/models/grok-4-20-beta) | xAI | 1240 |
| 45 | [GLM-4.7](/models/glm-4-7) | Z.AI | 1236 |
| 46 | [GPT-5.4](/models/gpt-5-4) | OpenAI | 1231 |
| 47 | [Inkling](/models/inkling) | Thinking Machines Lab | 1229 |
| 48 | [DeepSeek V4 Flash 0731](/models/deepseek-v4-flash-0731) | DeepSeek | 1219 |
| 49 | [Gemini 3 Flash](/models/gemini-3-flash) | Google | 1207 |
| 50 | [GPT-5.2](/models/gpt-5-2) | OpenAI | 1206 |
| 51 | [Grok 4.3](/models/grok-4-3) | xAI | 1206 |
| 52 | [Step 3.7 Flash](/models/step-3-7-flash) | StepFun | 1206 |
| 53 | [Claude Sonnet 4.5](/models/claude-sonnet-4-5) | Anthropic | 1201 |
| 54 | [Claude Sonnet 4.5 Thinking](/models/claude-sonnet-4-5-thinking) | Anthropic | 1201 |
| 55 | [GPT-5.1](/models/gpt-5-1) | OpenAI | 1198 |
| 56 | [GPT-5 (medium)](/models/gpt-5-medium) | OpenAI | 1196 |
| 57 | [GPT-5 (high)](/models/gpt-5-high) | OpenAI | 1196 |
| 58 | [Hy3](/models/hy3) | Tencent | 1193 |
| 59 | [Claude 4.1 Opus](/models/claude-4-1-opus) | Anthropic | 1188 |
| 60 | [Solar Pro 4](/models/solar-pro-4) | Upstage | 1187 |
| 61 | [DeepSeek V3.2](/models/deepseek-v3-2) | DeepSeek | 1186 |
| 62 | [DeepSeek V3.2 (Thinking)](/models/deepseek-v3-2-thinking) | DeepSeek | 1186 |
| 63 | [GLM-4.5](/models/glm-4-5) | Z.AI | 1181 |
| 64 | [Gemini 2.5 Pro](/models/gemini-2-5-pro) | Google | 1178 |
| 65 | [GPT-5.3 Codex](/models/gpt-5-3-codex) | OpenAI | 1173 |
| 66 | [GPT-5.1-Codex](/models/gpt-5-1-codex) | OpenAI | 1173 |
| 67 | [GLM-4.5-Air](/models/glm-4-5-air) | Z.AI | 1158 |
| 68 | [Claude 4 Sonnet](/models/claude-4-sonnet) | Anthropic | 1157 |
| 69 | [Nemotron 3 Ultra](/models/nemotron-3-ultra) | NVIDIA | 1149 |
| 70 | [Trinity-Large-Thinking](/models/trinity-large-thinking) | Arcee AI | 1148 |
| 71 | [Trinity-Large-Preview](/models/trinity-large-preview) | Arcee AI | 1148 |
| 72 | [Claude Haiku 4.5](/models/claude-haiku-4-5) | Anthropic | 1134 |
| 73 | [DeepSeek V3.1](/models/deepseek-v3-1) | DeepSeek | 1134 |
| 74 | [DeepSeek V3.1 (Reasoning)](/models/deepseek-v3-1-reasoning) | DeepSeek | 1134 |
| 75 | [Claude Haiku 4.5 Thinking](/models/claude-haiku-4-5-thinking) | Anthropic | 1134 |
| 76 | [DeepSeek V3](/models/deepseek-v3) | DeepSeek | 1131 |
| 77 | [Qwen3 Max](/models/qwen3-max) | Alibaba | 1130 |
| 78 | [Gemini 2.5 Flash](/models/gemini-2-5-flash) | Google | 1126 |
| 79 | [Mistral Medium 3](/models/mistral-medium-3) | Mistral | 1090 |
| 80 | [Kimi K2](/models/kimi-k2) | Moonshot AI | 1062 |
| 81 | [GPT-4.1](/models/gpt-4-1) | OpenAI | 1050 |
| 82 | [o3](/models/o3) | OpenAI | 1047 |
| 83 | [GPT-4.1 mini](/models/gpt-4-1-mini) | OpenAI | 1009 |
| 84 | [GPT-4.1 nano](/models/gpt-4-1-nano) | OpenAI | 984 |
| 85 | [GPT-OSS 120B](/models/gpt-oss-120b) | OpenAI | 979 |
| 86 | [Llama 4 Maverick](/models/llama-4-maverick) | Meta | 882 |
| 87 | [GPT-OSS 20B](/models/gpt-oss-20b) | OpenAI | 864 |
| 88 | [GPT-4o](/models/gpt-4o) | OpenAI | 842 |
| 89 | [Llama 4 Scout](/models/llama-4-scout) | Meta | 761 |

## FAQ

### What does Design Arena Website measure?

A display-only Design Arena website-generation Elo score surfaced on OpenRouter model benchmark pages.

### Which model scores highest on Design Arena Website?

Muse Spark 1.3 by Meta currently leads with a score of 1365 on Design Arena Website.

### How many models are evaluated on Design Arena Website?

89 AI models have been evaluated on Design Arena Website on BenchLM.

### Does Design Arena Website affect BenchLM's overall score?

Not directly. Design Arena Website is still displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Compare Top Models on Design Arena Website

- [Muse Spark 1.3 vs Kimi K3](/compare/kimi-k3-vs-muse-spark-1-3)
- [Kimi K3 vs MiMo-V2.6-Pro](/compare/kimi-k3-vs-mimo-v2-6-pro)
- [MiMo-V2.6-Pro vs Claude Fable 5.1](/compare/claude-fable-5-1-vs-mimo-v2-6-pro)
- [Claude Fable 5.1 vs Claude Opus 5](/compare/claude-fable-5-1-vs-claude-opus-5)
