gpt-oss-120bvsQwen3-Coder

gpt-oss-120b
Qwen3-Coder
Specifications
Parameters
117B480B
Context window
128k256k
API pricing
Input price
$1.00
Output price
$5.00
Cheapest input
$0.03AkashML$0.22Google
Cheapest output
$0.17AkashML$1.00DeepInfra
Benchmarks
BullshitBench v2
12%20%
Benchmarks
SWE-Bench Verified
62.4%
Humanity's Last Exam · no tools
14.9%
Humanity's Last Exam · with tools
19%
GPQA Diamond
80.1%
MMLU
90%
Overview
CompanyOpenAIQwen
Release dateAug 5 2025Jul 22 2025
AccessOpen WeightOpen Weight

Other comparisons

gpt-oss-120bvsClaude Fable 5.1Qwen3-CodervsClaude Fable 5.1gpt-oss-120bvsGemini 3.8 FlashQwen3-CodervsGemini 3.8 Flashgpt-oss-120bvsMuse Spark 1.3Qwen3-CodervsMuse Spark 1.3gpt-oss-120bvsGrok 4.7Qwen3-CodervsGrok 4.7gpt-oss-120bvsDeepSeek-V4.1-FlashQwen3-CodervsDeepSeek-V4.1-Flashgpt-oss-120bvsMistral Medium 3.5Qwen3-CodervsMistral Medium 3.5

Frequently asked questions

Qwen3-Coder leads gpt-oss-120b on 1 of the 1 benchmark they both report (BullshitBench v2). Only Qwen3-Coder has a verified first-party API price: $1.00 per million input tokens and $5.00 per million output tokens. No pay-as-you-go API rate is tracked for gpt-oss-120b. Qwen3-Coder shipped 14 days before gpt-oss-120b, so benchmark comparisons should account for the intervening progress.

gpt-oss-120b has 117B parameters, while Qwen3-Coder has 480B. Context windows are 128k (gpt-oss-120b) vs 256k (Qwen3-Coder).

On BullshitBench v2, Qwen3-Coder leads at 20% vs gpt-oss-120b at 12%.