Muse Spark 1.2vsQwen3.8-Max

Muse Spark 1.2
Qwen3.8-Max
Specifications
Parameters
2.4T
Context window
1M1M
API pricing
Cheapest input
$1.25Meta$2.00Alibaba
Cheapest output
$4.25Meta$6.00Alibaba
Benchmarks
BullshitBench v2
50%95%
DeepSWE 1.1
59.3%56.6%
Terminal-Bench 2.1
82.9%86.6%
Benchmarks
SWE-Bench Pro
67.7%
PaperBench
93%
NL2Repo-Bench
55.9%
QwenSWEBench V2
55.1%
Terminal-Bench 3.0
11.3%
JobBench
53.4%
CoWorkBench
74.8%
Toolathlon-Verified
72.5%
Humanity's Last Exam · with tools
43.6%
OSWorld-Verified
86.1%
CharXiv Reasoning
88.4%
BabyVision
82%
MMMU-Pro
82.3%
Overview
CompanyMetaQwen
Release dateAug 5 2026Aug 3 2026
AccessProprietaryProprietary

Other comparisons

Muse Spark 1.2vsClaude Fable 5.1Qwen3.8-MaxvsClaude Fable 5.1Muse Spark 1.2vsGPT-6 AstraQwen3.8-MaxvsGPT-6 AstraMuse Spark 1.2vsGemini 3.8 FlashQwen3.8-MaxvsGemini 3.8 FlashMuse Spark 1.2vsGrok 4.6Qwen3.8-MaxvsGrok 4.6Muse Spark 1.2vsDeepSeek-V4.1-FlashQwen3.8-MaxvsDeepSeek-V4.1-FlashMuse Spark 1.2vsMistral Medium 3.5Qwen3.8-MaxvsMistral Medium 3.5

Frequently asked questions

Qwen3.8-Max leads Muse Spark 1.2 on 2 of the 3 benchmarks they both report (BullshitBench v2, DeepSWE 1.1, Terminal-Bench 2.1). Qwen3.8-Max shipped 2 days before Muse Spark 1.2, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Muse Spark 1.2) vs 1M (Qwen3.8-Max).

On BullshitBench v2, Qwen3.8-Max leads at 95% vs Muse Spark 1.2 at 50%. On DeepSWE 1.1, Muse Spark 1.2 leads at 59.3% vs Qwen3.8-Max at 56.6%. On Terminal-Bench 2.1, Qwen3.8-Max leads at 86.6% vs Muse Spark 1.2 at 82.9%.