Muse GlimmervsQwen3.8-Max

Muse Glimmer
Qwen3.8-Max
Specifications
Parameters
30B
2.4T
Context window
1M
Benchmarks
Agentic coding
SWE-Bench Pro
51.2%
67.7%Best
Coding
SWE-Bench Verified
76%
Research reproduction
PaperBench
93%
Agentic terminal coding
Terminal-Bench 2.1
51.7%
86.6%Best
Multi-step tool use
MCP Atlas
75.5%
Professional tool use
JobBench
53.4%
Multidisciplinary reasoning
Humanity's Last Exam · no tools
22%
Science
GPQA Diamond
83.5%
Agentic computer use
OSWorld-Verified
65.9%
86.1%Best
Knowledge work
GDPval-AA v2
953
Chart reasoning
CharXiv Reasoning
78.8%
88.4%Best
Visual reasoning
BabyVision
82%
Multimodal reasoning
MMMU-Pro
74%
Community preference
Arena Elo (Text)
1497
Community preference (code)
Arena Elo (Code)
1667
Overview
CompanyMetaQwen
Release dateAug 10 2026Aug 3 2026
AccessOpen WeightProprietary

Which is better: Muse Glimmer or Qwen3.8-Max?

Qwen3.8-Max leads Muse Glimmer on 4 of the 4 benchmarks they both report (SWE-Bench Pro, Terminal-Bench 2.1, OSWorld-Verified, CharXiv Reasoning). Qwen3.8-Max shipped 7 days before Muse Glimmer, so benchmark comparisons should account for the intervening progress.

Muse Glimmer has 30B parameters, while Qwen3.8-Max has 2.4T. Muse Glimmer is open weight, while Qwen3.8-Max is proprietary.

On SWE-Bench Pro, Qwen3.8-Max leads at 67.7% vs Muse Glimmer at 51.2%. On Terminal-Bench 2.1, Qwen3.8-Max leads at 86.6% vs Muse Glimmer at 51.7%. On OSWorld-Verified, Qwen3.8-Max leads at 86.1% vs Muse Glimmer at 65.9%. On CharXiv Reasoning, Qwen3.8-Max leads at 88.4% vs Muse Glimmer at 78.8%.

Frequently asked questions

Muse Glimmer was released by Meta on Aug 10 2026.

Qwen3.8-Max was released by Qwen on Aug 3 2026.

Qwen3.8-Max leads on SWE-Bench Pro — Muse Glimmer 51.2% vs Qwen3.8-Max 67.7%.

Muse Glimmer is an open weight model released by Meta. Qwen3.8-Max is a proprietary model released by Qwen.

Other comparisons