Compare AI models

Specifications
Parameters
—21B
Context window
—128k
API pricing
Cheapest input
—$0.018Darkbloom
Cheapest output
—$0.09Darkbloom
Benchmarks
SWE-Bench Verified
49%60.7%
Overview
CompanyAnthropicOpenAI
Release dateOct 22 2024Aug 5 2025
AccessClosedOpen Weight
Model detailsView modelView model

Frequently asked questions

gpt-oss-20b leads Claude 3.5 Sonnet (upgraded) on 1 of the 1 benchmark they both report (SWE-Bench Verified). Claude 3.5 Sonnet (upgraded) shipped 287 days before gpt-oss-20b, so benchmark comparisons should account for the intervening progress.

Claude 3.5 Sonnet (upgraded) is closed, while gpt-oss-20b is open weight.

On SWE-Bench Verified, gpt-oss-20b leads at 60.7% vs Claude 3.5 Sonnet (upgraded) at 49%.