# Muse Spark 1.3 vs Raw Qwen3 4B Instruct 2507 direct logits

> Side-by-side benchmark comparison for Muse Spark 1.3 and Raw Qwen3 4B Instruct 2507 direct logits across agentic, coding, multimodal, knowledge, reasoning, multilingual, and math tasks.

- Canonical page: https://benchlm.ai/compare/muse-spark-1-3-vs-raw-qwen3-4b-instruct-2507
- Last updated: October 1, 2026

- Shared sourced benchmarks: 0
- HTML indexing: indexable
- Ranking lane: BenchAlign v5.8

## Quick Verdict

No benchmark verdict yet: there is no shared sourced benchmark row for Muse Spark 1.3 and Raw Qwen3 4B Instruct 2507 direct logits.

## Summary

- Muse Spark 1.3 and Raw Qwen3 4B Instruct 2507 direct logits do not currently share a sourced benchmark row. The mirror therefore compares metadata, pricing, context windows, and each model's separately reported coverage without naming a benchmark winner.

## Model Snapshot

| Property | Muse Spark 1.3 | Raw Qwen3 4B Instruct 2507 direct logits |
|----------|----------|----------|
| Creator | Meta | Alibaba |
| Type | Proprietary | Open Weight |
| Reasoning | Reasoning | Non-Reasoning |
| Context | 1M | null |
| Independent public score (not head-to-head) | null | null |
| Benchmarks Covered | 15 | 2 |
| Pricing (input/output) | $1.25 / $4.25 | Pricing unavailable / Pricing unavailable |

## Category Breakdown

### Agentic

- Winner: Insufficient shared evidence
- Muse Spark 1.3 public-lane score: Coming soon
- Raw Qwen3 4B Instruct 2507 direct logits public-lane score: Coming soon

| Benchmark | Muse Spark 1.3 | Raw Qwen3 4B Instruct 2507 direct logits | Winner |
|-----------|-----------|-----------|--------|
| Terminal-Bench 2.1 | 88.8% | Coming soon | Coming soon |
| JobBench | 64.9% | Coming soon | Coming soon |
| OSWorld 2.0 | 66.9% | Coming soon | Coming soon |
| DeepSearchQA | 89.4% | Coming soon | Coming soon |
| AutomationBench | 49.4% | Coming soon | Coming soon |
| ApprenticeBench | 19% | Coming soon | Coming soon |
| Terminal-Bench 2.1 (Vals) | 72.3% | Coming soon | Coming soon |
| CWE-bench v1 | 55.0% | Coming soon | Coming soon |

### Coding

- Winner: Insufficient shared evidence
- Muse Spark 1.3 public-lane score: Coming soon
- Raw Qwen3 4B Instruct 2507 direct logits public-lane score: Coming soon

| Benchmark | Muse Spark 1.3 | Raw Qwen3 4B Instruct 2507 direct logits | Winner |
|-----------|-----------|-----------|--------|
| Terminal-Bench 2.1 | 88.8% | Coming soon | Coming soon |
| DeepSWE | 75.4% | Coming soon | Coming soon |
| SWE-Atlas Codebase QnA | 59.4% | Coming soon | Coming soon |
| CursorBench 4.0 | 41.6% | Coming soon | Coming soon |

### Reasoning

- Winner: Insufficient shared evidence
- Muse Spark 1.3 public-lane score: 79.4 (#7/27)
- Raw Qwen3 4B Instruct 2507 direct logits public-lane score: Coming soon

| Benchmark | Muse Spark 1.3 | Raw Qwen3 4B Instruct 2507 direct logits | Winner |
|-----------|-----------|-----------|--------|
| MRCR v2 256K-512K | 98.5% | Coming soon | Coming soon |
| MRCR v2 512K-1M | 98.1% | Coming soon | Coming soon |
| JevBench 1.4 | Coming soon | 40.95 | Coming soon |
| JevBench 1.5 | Coming soon | 62.14 | Coming soon |

### Instruction Following

- Winner: Insufficient shared evidence
- Muse Spark 1.3 public-lane score: Coming soon
- Raw Qwen3 4B Instruct 2507 direct logits public-lane score: Coming soon

| Benchmark | Muse Spark 1.3 | Raw Qwen3 4B Instruct 2507 direct logits | Winner |
|-----------|-----------|-----------|--------|
| Gray Swan IPI (15 attempts) | 15.9% | Coming soon | Coming soon |

## FAQ

### Can I compare Muse Spark 1.3 and Raw Qwen3 4B Instruct 2507 direct logits on BenchLM yet?

Not fully yet. BenchLM is tracking both models, but sourced benchmark coverage is still incomplete for a fair score-level comparison.

### Why does this page show "coming soon" values?

BenchLM only calls winners when public benchmark coverage is available on both sides of the comparison.

## Related Comparisons

- [Muse Spark 1.3 vs Muse Spark 1.1](/compare/muse-spark-1-1-vs-muse-spark-1-3)
- [Raw Qwen3 4B Instruct 2507 direct logits vs Muse Spark 1.1](/compare/muse-spark-1-1-vs-raw-qwen3-4b-instruct-2507)
- [Muse Spark 1.3 vs Muse Spark 1.2](/compare/muse-spark-1-2-vs-muse-spark-1-3)
- [Raw Qwen3 4B Instruct 2507 direct logits vs Muse Spark 1.2](/compare/muse-spark-1-2-vs-raw-qwen3-4b-instruct-2507)

## Explore More

- [Muse Spark 1.3 profile](/models/muse-spark-1-3)
- [Raw Qwen3 4B Instruct 2507 direct logits profile](/models/raw-qwen3-4b-instruct-2507)
- [Compare Pricing](/llm-pricing)
- [Alternative Finder](/tools/alternative-finder)
- [LLM Selector](/tools/llm-selector)
- [Overall Rankings](/best/overall)
