Compare AI models

Specifications
Parameters
—117B
Context window
—128k
API pricing
Cheapest input
—$0.03AkashML
Cheapest output
—$0.17CoreWeave
Benchmarks
SWE-Bench Verified
49%62.4%
Overview
CompanyAnthropicOpenAI
Release dateOct 22 2024Aug 5 2025
AccessClosedOpen Weight
Model detailsView modelView model

Frequently asked questions

gpt-oss-120b leads Claude 3.5 Sonnet (upgraded) on 1 of the 1 benchmark they both report (SWE-Bench Verified). Claude 3.5 Sonnet (upgraded) shipped 287 days before gpt-oss-120b, so benchmark comparisons should account for the intervening progress.

Claude 3.5 Sonnet (upgraded) is closed, while gpt-oss-120b is open weight.

On SWE-Bench Verified, gpt-oss-120b leads at 62.4% vs Claude 3.5 Sonnet (upgraded) at 49%.