# OCRBench V2

> A native OCR benchmark for reading text from images across multilingual scripts, low-quality scans, handwriting, structured layouts, charts, and screenshots.

Canonical page: https://benchlm.ai/benchmarks/ocrbenchv2

- Category: [Multimodal & Grounded](/multimodal-grounded)
- Last updated: September 27, 2026

## About OCRBench V2

- Year: 2025
- Tasks: Image OCR tasks
- Format: Accuracy
- Difficulty: Native visual text understanding
- Paper: [OCRBench v2: An Improved Benchmark for Evaluating Large Multimodal Models on Visual Text Localization and Reasoning](https://arxiv.org/abs/2501.00321)

OCRBench V2 evaluates whether multimodal models can extract visual text directly from images before downstream reasoning or structure extraction. BenchLM stores Interfaze's reported score as a display-only OCR row.

OCRBench V2 is currently displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Leaderboard (5 models)

| Rank | Model | Creator | Score |
|------|-------|---------|-------|
| 1 | [Qwen3.8 Max](/models/qwen3-8-max) | Alibaba | 74.2% |
| 2 | [Qwen3.7 Plus](/models/qwen3-7-plus) | Alibaba | 70.7% |
| 3 | [Interfaze Beta](/models/interfaze-beta) | Interfaze | 70.7% |
| 4 | [Ternary Bonsai 2 27B](/models/ternary-bonsai-2-27b) | Prism ML | 56.9% |
| 5 | [LFM2.5-VL-3B](/models/lfm2-5-vl-3b) | LiquidAI | 47.5% |

## FAQ

### What does OCRBench V2 measure?

A native OCR benchmark for reading text from images across multilingual scripts, low-quality scans, handwriting, structured layouts, charts, and screenshots.

### Which model scores highest on OCRBench V2?

Qwen3.8 Max by Alibaba currently leads with a score of 74.2% on OCRBench V2.

### How many models are evaluated on OCRBench V2?

5 AI models have been evaluated on OCRBench V2 on BenchLM.

### Does OCRBench V2 affect BenchLM's overall score?

Not directly. OCRBench V2 is still displayed on BenchLM for reference, but it is excluded from the weighted scoring formula.

## Compare Top Models on OCRBench V2

- [Qwen3.8 Max vs Qwen3.7 Plus](/compare/qwen3-7-plus-vs-qwen3-8-max)
- [Qwen3.7 Plus vs Interfaze Beta](/compare/interfaze-beta-vs-qwen3-7-plus)
- [Interfaze Beta vs Ternary Bonsai 2 27B](/compare/interfaze-beta-vs-ternary-bonsai-2-27b)
- [Ternary Bonsai 2 27B vs LFM2.5-VL-3B](/compare/lfm2-5-vl-3b-vs-ternary-bonsai-2-27b)
