# Gemini 4 Argon Benchmark Scores & Performance

> Gemini 4 Argon by Google scores 64.59/100 overall, ranking #32 out of 525 AI models.

Canonical page: https://benchlm.ai/models/gemini-4-argon

Last updated: September 30, 2026

## Model Details

| Property | Value |
|----------|-------|
| Creator | Google |
| Source Type | Proprietary |
| Reasoning Type | Reasoning |
| Context Window | Coming soon |
| Official model card | [Google Gemini 4 Argon evaluation methodology](https://deepmind.google/models/evals-methodology/gemini-4-argon) |
| Overall Score | 64.59/100 |
| Overall Rank | #32 of 525 |

## Family & Coverage

- Family: Gemini 4
- Variant: base
- Benchmarks covered: 31 of 491
- Coverage note: BenchLM currently has partial benchmark coverage for this model, so the overall score is conservative.

## Agentic Benchmarks

| Benchmark | Score |
|-----------|-------|
| [AutomationBench](/benchmarks/automationbench) | 51.3% |
| [Finance Agent v2](/benchmarks/financeagentv2) | 65.4% |
| [Terminal-Bench 4.0](/benchmarks/terminal-bench-4) | 57.40% |
| [Agents' Last Exam](/benchmarks/agentslastexam) | 39.5% |
| [OSWorld 2.0](/benchmarks/osworld2) | 69.2% |
| [CWE-bench v1](/benchmarks/cwe-bench-v1) | 68.0% |
| [Terminal-Bench-Science 0.1 (6x verifier timeout)](/benchmarks/terminal-bench-science-6x-verifier) | 57.6% |
| [GDPval-AA](/benchmarks/gdpvalaanormalized) | 55.6% |
| [AA Briefcase](/benchmarks/aabriefcaseelo) | 1494 |
| [AA AutomationBench](/benchmarks/aaautomationbench) | 77.5% |
| [GDPval-AA](/benchmarks/gdpvalaa) | 1611 |
| [AA Terminal-Bench 4.0](/benchmarks/aaterminalbench4) | 57.1% |
| [GDP.pdf](/benchmarks/aagdppdf) | 21.8% |

## Coding Benchmarks

| Benchmark | Score |
|-----------|-------|
| [DeepSWE](/benchmarks/deepswe) | 77.9% |
| [FrontierSWE v2](/benchmarks/frontierswev2) | 55.1% |
| [Vibe Code Bench](/benchmarks/vibecodebench) | 91.90% |
| [PostTrainBench v1.1](/benchmarks/posttrainbench-v1-1) | 45.3% |
| [AA-SciCode](/benchmarks/aascicode) | 61.8% |

## Multimodal & Grounded Benchmarks

| Benchmark | Score |
|-----------|-------|
| [Chartography (no tools)](/benchmarks/chartography) | 71.6% |
| [LVBench](/benchmarks/lvbench) | 91.7% |

## Reasoning Benchmarks

| Benchmark | Score |
|-----------|-------|
| [Graphwalks BFS 128K](/benchmarks/graphwalksbfs128k) | 99.7% |
| [GraphWalks BFS 256K–1M](/benchmarks/graphwalks-bfs-256k-1m) | 84.2% |
| [AA-LCR](/benchmarks/lcr) | 79.7% |
| [CritPt](/benchmarks/critpt) | 27.1% |

## Knowledge Benchmarks

| Benchmark | Score |
|-----------|-------|
| [LABBench2](/benchmarks/labbench2) | 88.8% |
| [Artificial Analysis Intelligence Index](/benchmarks/artificialanalysis) | 52.6% |
| [AA-HLE](/benchmarks/aahle) | 57.1% |
| [AA-Omniscience Index](/benchmarks/aaomniscienceindex) | 42.4% |
| [AA-Omniscience Accuracy](/benchmarks/omniscienceaccuracy) | 49.9% |
| [AA-Omniscience Hallucination Rate](/benchmarks/omnisciencehallucinationrate) | 15.1% |

## Instruction Following Benchmarks

| Benchmark | Score |
|-----------|-------|
| [Gray Swan IPI (15 attempts)](/benchmarks/gray-swan-ipi) | 0.7% |

## Other Google Models

- [Gemini 3.8 Flash](/models/gemini-3-8-flash) - Score: 73.04
- [Gemini 3.7 Flash](/models/gemini-3-7-flash) - Score: 67.05
- [Gemini 3.1 Pro](/models/gemini-3-1-pro) - Score: 64.51
- [Gemini 3.6 Flash](/models/gemini-3-6-flash) - Score: 64.34
- [Gemini 3.5 Flash](/models/gemini-3-5-flash) - Score: 63.11
- [Gemini 3 Pro](/models/gemini-3-pro) - Score: 60.74
- [Gemini 3 Flash](/models/gemini-3-flash) - Score: 55.49
- [Gemini 3.5 Flash-Lite](/models/gemini-3-5-flash-lite) - Score: 50.74
- [Gemini 2.5 Pro](/models/gemini-2-5-pro) - Score: 50.17
- [Gemini 3.1 Flash-Lite](/models/gemini-3-1-flash-lite) - Score: 50.02
- [Gemma 4 26B A4B](/models/gemma-4-26b-a4b) - Score: 46.11
- [Gemini 2.5 Flash](/models/gemini-2-5-flash) - Score: 42.99
- [Gemma 4 31B](/models/gemma-4-31b) - Score: 40.39
- [Gemma 4 E4B](/models/gemma-4-e4b) - Score: 33.19
- [Gemma 4 E2B](/models/gemma-4-e2b) - Score: 32.39
- [Gemma 3 27B](/models/gemma-3-27b) - Score: 28.78
- [Gemma 4 12B](/models/gemma-4-12b) - Score: 28.25
- [Gemini 1.5 Pro](/models/gemini-1-5-pro) - Score: 27.92
- [Gemini 1.0 Pro](/models/gemini-1-0-pro) - Score: 13.04
- [Gemini 3 Pro Deep Think](/models/gemini-3-pro-deep-think) - Score: not computed
- [Gemini 3.8 Flash TTS](/models/gemini-3-8-flash-tts) - Score: not computed
- [Gemini 3.8 Flash-Lite TTS](/models/gemini-3-8-flash-lite-tts) - Score: not computed
- [Gemini 3.8 Live](/models/gemini-3-8-live) - Score: not computed
- [Gemini 3.8 Live Extended Thinking](/models/gemini-3-8-live-extended-thinking) - Score: not computed
- [Gemini 3.8 Flash Cyber](/models/gemini-3-8-flash-cyber) - Score: not computed
- [Gemini 3.5 Transcribe](/models/gemini-3-5-transcribe) - Score: not computed
- [Gemini 3.5 Flash Cyber](/models/gemini-3-5-flash-cyber) - Score: not computed
- [Gemini 3.1 Flash TTS Preview](/models/gemini-3-1-flash-tts-preview) - Score: not computed
- [Gemini 2.5 Flash Native Audio Preview (12-2025)](/models/gemini-2-5-flash-native-audio-preview-12-2025) - Score: not computed
- [Gemini 2.5 Flash TTS Preview](/models/gemini-2-5-flash-tts-preview) - Score: not computed
- [Gemini 2.5 Pro TTS Preview](/models/gemini-2-5-pro-tts-preview) - Score: not computed
- [Gemini 3.1 Flash Live Preview](/models/gemini-3-1-flash-live-preview) - Score: not computed
