Gemini 3.5 FlashvsQwen3.5

Gemini 3.5 Flash
Qwen3.5
Specifications
Parameters
397B
Context window
1M
Benchmarks
Nonsense detection
BullshitBench v2
20%
Prompt injection robustness
Gray Swan IPI · k = 1
14.1%
Prompt injection robustness
Gray Swan IPI · k = 10
54.2%
Prompt injection robustness
Gray Swan IPI · k = 15
60.5%
Agentic coding
SWE-Bench Pro
55.1%
Coding
SWE-Bench Verified
76.4%
Multilingual coding
SWE-Bench Multilingual
69.3%
Agentic coding
CursorBench v3.2
48.8%
Agentic coding
CursorBench v3.1
49.8%
Agentic coding
DeepSWE 1.1
37%
ML engineering
MLE-Bench
49.7%
Agentic terminal coding
Terminal-Bench 2.1
76.2%
Agentic terminal coding
Terminal-Bench 2.0
52.5%
Multi-step tool use
MCP Atlas
83.6%
General tool use
Toolathlon
56.5%
Browser agent
BU Bench
58%
Web browsing
BrowseComp
69%
Multidisciplinary reasoning
Humanity's Last Exam · no tools
40.2%Best
28.7%
Abstract reasoning
ARC-AGI-2
72.1%
Science
GPQA Diamond
88.4%
Agentic computer use
OSWorld-Verified
78.4%Best
62.2%
Agentic financial analysis
Finance Agent v2
57.9%
Knowledge work
GDPval-AA
1656
Knowledge work
GDPval-AA v2
1349
Chart reasoning
CharXiv Reasoning
84.2%Best
80.8%
Multimodal reasoning
MMMU-Pro
83.6%Best
79%
Multimodal
MMMU
85%
Spatial reasoning
Blueprint-Bench 2
33.6%
Long context
MRCR v2 (8-needle) · 128k average
77.3%
Long context
MRCR v2 (8-needle) · 1M pointwise
26.6%
Community preference
Arena Elo (Text)
1476
Community preference (code)
Arena Elo (Code)
1492
Overview
CompanyGoogleQwen
Release dateMay 19 2026Feb 16 2026
AccessProprietaryOpen Weight

Which is better: Gemini 3.5 Flash or Qwen3.5?

Gemini 3.5 Flash leads Qwen3.5 on 4 of the 4 benchmarks they both report (Humanity's Last Exam, OSWorld-Verified, CharXiv Reasoning, MMMU-Pro). Qwen3.5 shipped 92 days before Gemini 3.5 Flash, so benchmark comparisons should account for the intervening progress.

Gemini 3.5 Flash is proprietary, while Qwen3.5 is open weight.

On Humanity's Last Exam · no tools, Gemini 3.5 Flash leads at 40.2% vs Qwen3.5 at 28.7%. On OSWorld-Verified, Gemini 3.5 Flash leads at 78.4% vs Qwen3.5 at 62.2%. On CharXiv Reasoning, Gemini 3.5 Flash leads at 84.2% vs Qwen3.5 at 80.8%. On MMMU-Pro, Gemini 3.5 Flash leads at 83.6% vs Qwen3.5 at 79%.

Frequently asked questions

Gemini 3.5 Flash was released by Google on May 19 2026.

Qwen3.5 was released by Qwen on Feb 16 2026.

Gemini 3.5 Flash leads on Humanity's Last Exam · no tools — Gemini 3.5 Flash 40.2% vs Qwen3.5 28.7%.

Gemini 3.5 Flash is a proprietary model released by Google. Qwen3.5 is an open weight model released by Qwen.

Other comparisons