# Gemini 3.5 Flash Benchmark Scores & Performance

> Gemini 3.5 Flash by Google scores 63.95/100 overall, ranking #41 out of 783 AI models.

Canonical page: https://benchlm.ai/models/gemini-3-5-flash

Last updated: October 2, 2026

## Model Details

| Property | Value |
|----------|-------|
| Creator | Google |
| Source Type | Proprietary |
| Reasoning Type | Reasoning |
| Context Window | 1M |
| Overall Score | 63.95/100 |
| Overall Rank | #41 of 783 |

## Family & Coverage

- Family: Gemini 3.5 Flash
- Variant: base
- Benchmarks covered: 49 of 645
- Sibling models: [Gemini 3.5 Flash Cyber](/models/gemini-3-5-flash-cyber)
- Related earlier model: [Gemini 3 Flash](/models/gemini-3-flash)
- Coverage note: BenchLM currently has partial benchmark coverage for this model, so the overall score is conservative.

## Agentic Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [Terminal-Bench 2.1](/benchmarks/terminalbench21) | 76.2% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [MCP Atlas](/benchmarks/mcpatlas) | 83.6% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [Toolathlon](/benchmarks/toolathlon) | 56.5% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [OSWorld-Verified](/benchmarks/osworld-verified) | 78.4% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [Finance Agent v2](/benchmarks/financeagentv2) | 57.9% | [Vals AI: Finance Agent v2](https://www.vals.ai/benchmarks/fabv2) |
| [GDPval-AA](/benchmarks/gdpvalaa) | 1345 | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [τ²-bench results](/benchmarks/tau2-bench) | 95.3% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [GDPval-AA](/benchmarks/gdpvalaanormalized) | 42.2% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [APEX-Agents-AA](/benchmarks/apexagentsaa) | 47.1% | [Artificial Analysis: apex-agents-aa leaderboard](https://artificialanalysis.ai/evaluations/apex-agents-aa) |
| [Gert Labs](/benchmarks/gertlabs) | 61.85% | [Gert Labs rankings](https://gertlabs.com/rankings) |
| [ResearchClawBench](/benchmarks/researchclawbench) | 18.0% | [ResearchClawBench leaderboard](https://internscience.github.io/ResearchClawBench-Home/) |
| [AA EnterpriseOps-Gym](/benchmarks/aaenterpriseopsgym) | 50.1% | [Artificial Analysis: enterprise-ops-gym-aa leaderboard](https://artificialanalysis.ai/evaluations/enterprise-ops-gym-aa) |
| [Terminal-Bench 2.1 (Vals)](/benchmarks/valsterminalbench21) | 74.2% | [Vals AI: Terminal-Bench 2.1 leaderboard](https://www.vals.ai/models/google_gemini-3.5-flash) |
| [AA Agentic Index](/benchmarks/aaagenticindex) | 27.3% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |

## Coding Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [Terminal-Bench 2.1](/benchmarks/terminalbench21) | 76.2% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [SWE-bench Pro](/benchmarks/swe-bench-pro) | 55.1% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [SciCode](/benchmarks/scicode) | 53.1% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [Vibe Code Bench](/benchmarks/vibecodebench) | 48.68% | [Vals AI: Vibe Code Bench v1.1](https://www.vals.ai/benchmarks/vibe-code) |
| [cursorBench31](/benchmarks/cursorbench31) | 49.8% | [Cursor evals: CursorBench 3.1](https://cursor.com/evals) |
| [CursorBench 3.2](/benchmarks/cursorbench32) | 48.8% | [Cursor evals: CursorBench 3.2](https://cursor.com/cursorbench) |
| [AA-SciCode](/benchmarks/aascicode) | 53.9% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [LiveCodeBench (Vals)](/benchmarks/valslivecodebench) | 87.6% | [Vals AI: LiveCodeBench leaderboard](https://www.vals.ai/models/google_gemini-3.5-flash) |
| [SWE-bench (Vals)](/benchmarks/valsswebench) | 78.8% | [Vals AI: SWE-bench leaderboard](https://www.vals.ai/models/google_gemini-3.5-flash) |
| [AA Coding Index](/benchmarks/aacodingindex) | 70.1% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |

## Multimodal & Grounded Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [CharXiv](/benchmarks/charxiv) | 84.2% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [MMMU-Pro](/benchmarks/mmmu-pro) | 83.6% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [Blueprint-Bench 2](/benchmarks/blueprintbench2) | 33.6% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [AA-MMMU-Pro](/benchmarks/aammmupro) | 84.3% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [Design Arena Website](/benchmarks/designarenawebsite) | 1272 | [OpenRouter model benchmarks](https://openrouter.ai/google/gemini-3.5-flash/benchmarks) |

## Reasoning Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [MRCRv2](/benchmarks/mrcrv2) | 77.3% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [MRCR 1M](/benchmarks/mrcr1m) | 26.6% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [ARC-AGI-2](/benchmarks/arc-agi-2) | 72.1% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [AA-LCR](/benchmarks/lcr) | 69.3% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [CritPt](/benchmarks/critpt) | 13.1% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |

## Knowledge Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [Artificial Analysis Intelligence Index](/benchmarks/artificialanalysis) | 50.2% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [GPQA](/benchmarks/gpqa) | 92.2% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [GPQA-D](/benchmarks/gpqa-diamond) | 92.7% | [Vals AI: GPQA Diamond mirror](https://www.vals.ai/benchmarks/gpqa) |
| [HLE](/benchmarks/hle) | 40.2% | [Google / Google DeepMind: Gemini 3.5 Flash launch screenshots](https://x.com/GoogleDeepMind) |
| [AA-Omniscience Accuracy](/benchmarks/omniscienceaccuracy) | 51.9% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [AA-Omniscience Hallucination Rate](/benchmarks/omnisciencehallucinationrate) | 60.7% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [AA-GPQA Diamond](/benchmarks/aagpqadiamond) | 92.2% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [AA-HLE](/benchmarks/aahle) | 42.7% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [AA-Omniscience Index](/benchmarks/aaomniscienceindex) | 21.2% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [GPQA Diamond (Vals)](/benchmarks/valsgpqadiamond) | 92.7% | [Vals AI: GPQA Diamond leaderboard](https://www.vals.ai/models/google_gemini-3.5-flash) |
| [MMLU-Pro (Vals)](/benchmarks/valsmmlupro) | 89.5% | [Vals AI: MMLU Pro leaderboard](https://www.vals.ai/models/google_gemini-3.5-flash) |

## Instruction Following Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [IFBench](/benchmarks/ifbench) | 76.3% | [Artificial Analysis: Gemini 3.5 Flash](https://artificialanalysis.ai/models/gemini-3-5-flash) |
| [AA-IFBench](/benchmarks/aaifbench) | 76.3% | [Artificial Analysis model benchmarks](https://artificialanalysis.ai/models/gemini-3-5-flash) |

## Mathematics Benchmarks

| Benchmark | Score | Source |
|-----------|-------|--------|
| [FrontierMath v2 (Tiers 1-3)](/benchmarks/frontiermathv2tiers13) | 38.966% | [Epoch AI FrontierMath v2 leaderboard](https://epoch.ai/benchmarks/frontiermath-tier-4-v2?view=graph&tab=leaderboard) |
| [FrontierMath v2 (Tier 4)](/benchmarks/frontiermathv2tier4) | 14.583% | [Epoch AI FrontierMath v2 leaderboard](https://epoch.ai/benchmarks/frontiermath-tier-4-v2?view=graph&tab=leaderboard) |

## Other Google Models

- [Gemini 4 Argon](/models/gemini-4-argon) - Score: 77.22
- [Gemini 3.8 Flash](/models/gemini-3-8-flash) - Score: 73.95
- [Gemini 3.7 Flash](/models/gemini-3-7-flash) - Score: 67.98
- [Gemini 3.6 Flash](/models/gemini-3-6-flash) - Score: 65.16
- [Gemini 3.1 Pro](/models/gemini-3-1-pro) - Score: 65.09
- [Gemini 3 Pro](/models/gemini-3-pro) - Score: 61.57
- [Gemini 3 Flash](/models/gemini-3-flash) - Score: 56.3
- [Gemini 3.5 Flash-Lite](/models/gemini-3-5-flash-lite) - Score: 51.54
- [Gemini 2.5 Pro](/models/gemini-2-5-pro) - Score: 50.98
- [Gemini 3.1 Flash-Lite](/models/gemini-3-1-flash-lite) - Score: 49.51
- [Gemma 4 26B A4B](/models/gemma-4-26b-a4b) - Score: 46.89
- [Gemini 2.5 Flash](/models/gemini-2-5-flash) - Score: 43.74
- [Gemma 4 31B](/models/gemma-4-31b) - Score: 41.07
- [Gemma 4 12B](/models/gemma-4-12b) - Score: 32.11
- [Gemma 4 E4B](/models/gemma-4-e4b) - Score: 31.45
- [Gemma 4 E2B](/models/gemma-4-e2b) - Score: 30.32
- [Gemma 3 27B](/models/gemma-3-27b) - Score: 29.47
- [Gemini 1.5 Pro](/models/gemini-1-5-pro) - Score: 28.16
- [Gemini 1.0 Pro](/models/gemini-1-0-pro) - Score: 13.94
- [Gemini 3 Pro Deep Think](/models/gemini-3-pro-deep-think) - Score: not computed
- [Gemini 3.8 Flash TTS](/models/gemini-3-8-flash-tts) - Score: not computed
- [Gemini 3.8 Flash-Lite TTS](/models/gemini-3-8-flash-lite-tts) - Score: not computed
- [Gemini 3.8 Live](/models/gemini-3-8-live) - Score: not computed
- [Gemini 3.8 Live Extended Thinking](/models/gemini-3-8-live-extended-thinking) - Score: not computed
- [Gemini 3.8 Flash Cyber](/models/gemini-3-8-flash-cyber) - Score: not computed
- [Gemini 3.5 Transcribe](/models/gemini-3-5-transcribe) - Score: not computed
- [Gemini 3.5 Flash Cyber](/models/gemini-3-5-flash-cyber) - Score: not computed
- [Gemini 3.1 Flash TTS Preview](/models/gemini-3-1-flash-tts-preview) - Score: not computed
- [Gemini 2.5 Flash Native Audio Preview (12-2025)](/models/gemini-2-5-flash-native-audio-preview-12-2025) - Score: not computed
- [Gemini 2.5 Flash TTS Preview](/models/gemini-2-5-flash-tts-preview) - Score: not computed
- [Gemini 2.5 Pro TTS Preview](/models/gemini-2-5-pro-tts-preview) - Score: not computed
- [Gemini 3.1 Flash Live Preview](/models/gemini-3-1-flash-live-preview) - Score: not computed
