Claude Opus 4.7vsgpt-oss-120b

Claude Opus 4.7
gpt-oss-120b
Specifications
Parameters
117B
Context window
1M128k
API pricing
Input price
$5.00
Output price
$25.00
Cached input price
$0.50
Cheapest input
$5.00Amazon Bedrock$0.03AkashML
Cheapest output
$25.00Amazon Bedrock$0.17AkashML
Benchmarks
BullshitBench v2
83%11%
SWE-Bench Verified
87.6%62.4%
Humanity's Last Exam · no tools
46.9%14.9%
Humanity's Last Exam · with tools
54.7%19%
GPQA Diamond
94.2%80.1%
Benchmarks
SWE-Bench Pro
64.3%
SWE-Bench Multilingual
80.5%
Next.js Evals
69%
Terminal-Bench 2.1
66.1%
Terminal-Bench 2.0
69.4%
MCP Atlas
79.1%
BrowseComp
79.3%
CyberGym
73.1%
ARC-AGI-2
75.8%
FrontierMath · Tier 1–3
43.8%
FrontierMath · Tier 4
22.9%
MMLU
90%
OSWorld-Verified
78%
Finance Agent v2
51.5%
GDPval-AA
1753
GDPval (win/tie rate)
80.3%
CharXiv Reasoning
82.1%
MMMU-Pro
75.2%
Blueprint-Bench 2
24.5%
MRCR v2 (8-needle) · 128k average
59.3%
Overview
CompanyAnthropicOpenAI
Release dateApr 16 2026Aug 5 2025
AccessProprietaryOpen Weight

Other comparisons

Claude Opus 4.7vsGemini 3.7 Flashgpt-oss-120bvsGemini 3.7 FlashClaude Opus 4.7vsMuse Glimmergpt-oss-120bvsMuse GlimmerClaude Opus 4.7vsGrok 4.6gpt-oss-120bvsGrok 4.6Claude Opus 4.7vsDeepSeek-V4-Pro-0813gpt-oss-120bvsDeepSeek-V4-Pro-0813Claude Opus 4.7vsMistral Medium 3.5gpt-oss-120bvsMistral Medium 3.5Claude Opus 4.7vsKimi K3gpt-oss-120bvsKimi K3

Frequently asked questions

Claude Opus 4.7 leads gpt-oss-120b on 5 of the 5 benchmarks they both report (BullshitBench v2, SWE-Bench Verified, Humanity's Last Exam, GPQA Diamond). Only Claude Opus 4.7 has a verified first-party API price: $5.00 per million input tokens and $25.00 per million output tokens. No pay-as-you-go API rate is tracked for gpt-oss-120b. gpt-oss-120b shipped 254 days before Claude Opus 4.7, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 4.7) vs 128k (gpt-oss-120b). Claude Opus 4.7 is proprietary, while gpt-oss-120b is open weight.

On BullshitBench v2, Claude Opus 4.7 leads at 83% vs gpt-oss-120b at 11%. On SWE-Bench Verified, Claude Opus 4.7 leads at 87.6% vs gpt-oss-120b at 62.4%. On Humanity's Last Exam · no tools, Claude Opus 4.7 leads at 46.9% vs gpt-oss-120b at 14.9%. On Humanity's Last Exam · with tools, Claude Opus 4.7 leads at 54.7% vs gpt-oss-120b at 19%. On GPQA Diamond, Claude Opus 4.7 leads at 94.2% vs gpt-oss-120b at 80.1%.

Claude Opus 4.7 was released by Anthropic on Apr 16 2026.

gpt-oss-120b was released by OpenAI on Aug 5 2025.

Claude Opus 4.7 leads on SWE-Bench Verified — Claude Opus 4.7 87.6% vs gpt-oss-120b 62.4%.

Claude Opus 4.7 leads on Humanity's Last Exam · no tools — Claude Opus 4.7 46.9% vs gpt-oss-120b 14.9%.

Only Claude Opus 4.7 has a verified first-party API price: $5.00 per million input tokens and $25.00 per million output tokens. No pay-as-you-go API rate is tracked for gpt-oss-120b. Rates are pay-as-you-go API prices verified on August 18, 2026.

Claude Opus 4.7 has a 1M context window; gpt-oss-120b has 128k.

Claude Opus 4.7 is a proprietary model released by Anthropic. gpt-oss-120b is an open weight model released by OpenAI.