Claude Opus 4.8vsGPT-6 Astra

Claude Opus 4.8
GPT-6 Astra
Specifications
Context window
1M1.05M
API pricing
Input price
$5.00$10.00
Output price
$25.00$50.00
Cached input price
$0.50$1.00
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
Terminal-Bench 4.0
23.64%57.9%
BrowseComp
84.3%91.5%
Benchmarks
BullshitBench v2
95%
Gray Swan IPI · k = 1
0.5%
Gray Swan IPI · k = 10
4.1%
Gray Swan IPI · k = 15
5.5%
Auto-review circumvention (Internal)
0%
SWE-Bench Pro
69.2%
SWE-Bench Verified
88.6%
SWE-Bench Multilingual
84.4%
DeepSWE 1.1
74.1%
DeepSWE 1.0
55.8%
FrontierCode v1.1 (Main) · main split
53.3%
FrontierCode v1.1 (Extended) · extended split
64.5%
Next.js Evals
81%
AA Coding Agent Index
67
Database Migration Tasks (OpenAI Internal)
63.9%
BenchCAD
95.9%
Frontier-Bench v0.1
21.1%
Terminal-Bench 2.1
74.6%
Terminal-Bench-Science 0.1
64.6%
BU Bench
74%
ExploitBench
100%
Humanity's Last Exam · no tools
49.8%
Humanity's Last Exam · with tools
57.9%
ARC-AGI-3
99.9%
ARC-AGI-2
72.08%
FrontierMath · Tier 4 (v2)
97.6%
GeneBench-Pro
39%
MedChemBench (Internal)
49.7%
GPQA Diamond
96%
OSWorld-Verified
83.4%
Agent's Last Exam · pass@1
59.3%
SRE-Bench
99.2%
AutomationBench
41.4%
Finance Agent v2
53.9%
Harvey's Legal Agent Benchmark
9.58%
TaxEval v2
75.63%
HealthBench Professional · length-adjusted
63.4%
MedScribe
85.75%
AA Intelligence Index
61.2
GDPval-AA
1890
GDPval-AA v2
1600
Design Tasks (OpenAI Internal)
50%
Data Science Tasks (OpenAI Internal)
40.9%
OpenScore String Quartets
0.84
Overview
CompanyAnthropicOpenAI
Release dateMay 28 2026Sep 3 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 4.8vsGemini 3.8 FlashGPT-6 AstravsGemini 3.8 FlashClaude Opus 4.8vsMuse Spark 1.3GPT-6 AstravsMuse Spark 1.3Claude Opus 4.8vsGrok 4.6GPT-6 AstravsGrok 4.6Claude Opus 4.8vsDeepSeek-V4-Pro-0813GPT-6 AstravsDeepSeek-V4-Pro-0813Claude Opus 4.8vsMistral Medium 3.5GPT-6 AstravsMistral Medium 3.5Claude Opus 4.8vsKimi K3GPT-6 AstravsKimi K3

Frequently asked questions

GPT-6 Astra leads Claude Opus 4.8 on 2 of the 2 benchmarks they both report (Terminal-Bench 4.0, BrowseComp). Claude Opus 4.8 is cheaper on both input and output: $5.00 vs $10.00 per million input tokens, and $25.00 vs $50.00 per million output tokens. Figures are base-tier rates. Claude Opus 4.8 shipped 98 days before GPT-6 Astra, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 4.8) vs 1.05M (GPT-6 Astra).

On Terminal-Bench 4.0, GPT-6 Astra leads at 57.9% vs Claude Opus 4.8 at 23.64%. On BrowseComp, GPT-6 Astra leads at 91.5% vs Claude Opus 4.8 at 84.3%.

Claude Opus 4.8 was released by Anthropic on May 28 2026.

GPT-6 Astra was released by OpenAI on Sep 3 2026.

GPT-6 Astra leads on Terminal-Bench 4.0 — Claude Opus 4.8 23.64% vs GPT-6 Astra 57.9%.

Claude Opus 4.8 is cheaper on both input and output: $5.00 vs $10.00 per million input tokens, and $25.00 vs $50.00 per million output tokens. Figures are base-tier rates. Rates are pay-as-you-go API prices verified on August 18, 2026.

Claude Opus 4.8 has a 1M context window; GPT-6 Astra has 1.05M.