Claude Opus 5.5vsGPT-6 Astra

Claude Opus 5.5
GPT-6 Astra
Specifications
Context window
1M1.05M
API pricing
Input price
$4.00$10.00
Output price
$20.00$50.00
Cached input price
$0.20$1.00
Cheapest input
$5.00OpenAI
Cheapest output
$25.00OpenAI
Benchmarks
FrontierCode v1.1 (Main) · main split
54.4%53.3%
Terminal-Bench 4.0
66.4%57.9%
Terminal-Bench-Science 0.1
58.7%64.6%
AutomationBench
40%41.4%
Benchmarks
BullshitBench v2
69%
Auto-review circumvention (Internal)
0%
DeepSWE 1.1
74.1%
FrontierCode v1.1 (Extended) · extended split
64.5%
Next.js Evals
90%
AA Coding Agent Index
67
Database Migration Tasks (OpenAI Internal)
63.9%
BenchCAD
95.9%
BrowseComp
91.5%
ExploitBench
100%
Humanity's Last Exam · with tools
67.7%
ARC-AGI-3
99.9%
ARC-AGI-2
95%
FrontierMath · Tier 4 (v2)
97.6%
GeneBench-Pro
39%
MedChemBench (Internal)
49.7%
GPQA Diamond
96%
OSWorld 2.0
81.8%
Agent's Last Exam · pass@1
59.3%
SRE-Bench
99.2%
HealthBench Professional · length-adjusted
63.4%
AA Intelligence Index
61.2
GDPval-AA v2.1
1846
Design Tasks (OpenAI Internal)
50%
Data Science Tasks (OpenAI Internal)
40.9%
Chartography · with tools
89%
OpenScore String Quartets
0.84
threejseval
1957
Overview
CompanyAnthropicOpenAI
Release dateSep 22 2026Sep 3 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 5.5vsGemini 3.8 FlashGPT-6 AstravsGemini 3.8 FlashClaude Opus 5.5vsMuse Spark 1.3GPT-6 AstravsMuse Spark 1.3Claude Opus 5.5vsGrok 4.7GPT-6 AstravsGrok 4.7Claude Opus 5.5vsDeepSeek-V4.1-FlashGPT-6 AstravsDeepSeek-V4.1-FlashClaude Opus 5.5vsMistral Medium 3.5GPT-6 AstravsMistral Medium 3.5Claude Opus 5.5vsKimi K3GPT-6 AstravsKimi K3

Frequently asked questions

Claude Opus 5.5 and GPT-6 Astra are evenly matched across the 4 benchmarks they both report (FrontierCode v1.1 (Main), Terminal-Bench 4.0, Terminal-Bench-Science 0.1, AutomationBench). Claude Opus 5.5 is cheaper on both input and output: $4.00 vs $10.00 per million input tokens, and $20.00 vs $50.00 per million output tokens. Figures are base-tier rates. GPT-6 Astra shipped 19 days before Claude Opus 5.5, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 5.5) vs 1.05M (GPT-6 Astra).

On FrontierCode v1.1 (Main) · main split, Claude Opus 5.5 leads at 54.4% vs GPT-6 Astra at 53.3%. On Terminal-Bench 4.0, Claude Opus 5.5 leads at 66.4% vs GPT-6 Astra at 57.9%. On Terminal-Bench-Science 0.1, GPT-6 Astra leads at 64.6% vs Claude Opus 5.5 at 58.7%. On AutomationBench, GPT-6 Astra leads at 41.4% vs Claude Opus 5.5 at 40%.