Claude Opus 5vsGPT-6 Astra

Claude Opus 5
GPT-6 Astra
Specifications
Context window
1M1.05M
API pricing
Input price
$5.00$10.00
Output price
$25.00$50.00
Cached input price
$0.50$1.00
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
DeepSWE 1.1
68.8%74.1%
FrontierCode v1.1 (Main) · main split
53.4%53.3%
Terminal-Bench 4.0
51.82%57.9%
Terminal-Bench-Science 0.1
29%64.6%
BrowseComp
90.8%91.5%
ARC-AGI-3
30.2%99.9%
AutomationBench
26%41.4%
Benchmarks
BullshitBench v2
73%
Gray Swan IPI · k = 1
0.2%
Gray Swan IPI · k = 10
1.6%
Gray Swan IPI · k = 15
2%
Auto-review circumvention (Internal)
0%
SWE-Bench Pro
79.2%
SWE-Bench Verified
96%
SWE-Bench Multilingual
89.5%
SWE-Bench Multimodal
59.4%
FrontierCode v1.1 (Extended) · extended split
64.5%
Next.js Evals
92%
Supabase Evals · with skills
91.3%
Supabase Evals · no skills
89.9%
AA Coding Agent Index
67
Database Migration Tasks (OpenAI Internal)
63.9%
BenchCAD
95.9%
Frontier-Bench v0.1
43.3%
ExploitBench
100%
Humanity's Last Exam · no tools
56.3%
Humanity's Last Exam · with tools
64.7%
ARC-AGI-2
90.4%
FrontierMath · Tier 4 (v2)
97.6%
BioMysteryBench · hard
49.4%
BioMysteryBench · human solved
90.1%
GeneBench-Pro
39%
MedChemBench (Internal)
49.7%
GPQA Diamond
96%
OSWorld 2.0
70.6%
Agent's Last Exam · pass@1
59.3%
SRE-Bench
99.2%
Harvey's Legal Agent Benchmark (Held-out)
11.7%
HealthBench Professional
59.8%
HealthBench Professional · length-adjusted
63.4%
AA Intelligence Index
61.2
GDPval-AA v2
1861
Design Tasks (OpenAI Internal)
50%
Data Science Tasks (OpenAI Internal)
40.9%
AA-Briefcase
1685
OpenScore String Quartets
0.84
Overview
CompanyAnthropicOpenAI
Release dateJul 24 2026Sep 3 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 5vsGemini 3.8 FlashGPT-6 AstravsGemini 3.8 FlashClaude Opus 5vsMuse Spark 1.3GPT-6 AstravsMuse Spark 1.3Claude Opus 5vsGrok 4.6GPT-6 AstravsGrok 4.6Claude Opus 5vsDeepSeek-V4-Pro-0813GPT-6 AstravsDeepSeek-V4-Pro-0813Claude Opus 5vsMistral Medium 3.5GPT-6 AstravsMistral Medium 3.5Claude Opus 5vsKimi K3GPT-6 AstravsKimi K3

Frequently asked questions

GPT-6 Astra leads Claude Opus 5 on 6 of the 7 benchmarks they both report. Claude Opus 5 is cheaper on both input and output: $5.00 vs $10.00 per million input tokens, and $25.00 vs $50.00 per million output tokens. Figures are base-tier rates. Claude Opus 5 shipped 41 days before GPT-6 Astra, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 5) vs 1.05M (GPT-6 Astra).

On DeepSWE 1.1, GPT-6 Astra leads at 74.1% vs Claude Opus 5 at 68.8%. On FrontierCode v1.1 (Main) · main split, Claude Opus 5 leads at 53.4% vs GPT-6 Astra at 53.3%. On Terminal-Bench 4.0, GPT-6 Astra leads at 57.9% vs Claude Opus 5 at 51.82%. On Terminal-Bench-Science 0.1, GPT-6 Astra leads at 64.6% vs Claude Opus 5 at 29%. On BrowseComp, GPT-6 Astra leads at 91.5% vs Claude Opus 5 at 90.8%. On ARC-AGI-3, GPT-6 Astra leads at 99.9% vs Claude Opus 5 at 30.2%. On AutomationBench, GPT-6 Astra leads at 41.4% vs Claude Opus 5 at 26%.

Claude Opus 5 was released by Anthropic on Jul 24 2026.

GPT-6 Astra was released by OpenAI on Sep 3 2026.

GPT-6 Astra leads on DeepSWE 1.1 — Claude Opus 5 68.8% vs GPT-6 Astra 74.1%.

GPT-6 Astra leads on ARC-AGI-3 — Claude Opus 5 30.2% vs GPT-6 Astra 99.9%.

Claude Opus 5 is cheaper on both input and output: $5.00 vs $10.00 per million input tokens, and $25.00 vs $50.00 per million output tokens. Figures are base-tier rates. Rates are pay-as-you-go API prices verified on August 18, 2026.

Claude Opus 5 has a 1M context window; GPT-6 Astra has 1.05M.