BenchLM comparison
Claude Opus 5.5
Anthropic
86.43 /100
Supported · public rank #1
vs
GPT-6 Astra
OpenAI
84.88 /100
Supported · public rank #2
CategoryClaude Opus 5.5GPT-6 AstraReading
Agentic89
Supported · #1/123
70.7
Supported · #7/123
Claude Opus 5.5 leads
Coding83.3
Supported · #2/146
76.1
Supported · #4/146
Claude Opus 5.5 leads
Reasoning86.1
#3/28
93.4
#1/28
Directional only
Multimodal92.2
#3/54
87.3
Unranked · 3 rankable rows
Not comparable
Knowledge90
Supported · #1/177
86.2
Supported · #3/177
Claude Opus 5.5 leads
Multilingual——Not comparable
Instruction following——Not comparable
Math—85.5
Unranked · 1 rankable row
Not comparable
Methodology bench-align-v5.8-2026-09-30Claude Opus 5.5 vs GPT-6 Astra benchmark comparison by BenchLM.ai