DeepSeek-V4-Flash-0731vsGPT-5.6 Sol

DeepSeek-V4-Flash-0731
GPT-5.6 Sol
API pricing
Input price
$0.22$5.00
Output price
$0.66$30.00
Cached input price
$0.007$0.50
Cheapest input
$0.04OpenInference$4.40Amazon Bedrock
Cheapest output
$0.10OpenInference$22.00Amazon Bedrock
Benchmarks
BullshitBench v2
39%48%
Terminal-Bench 2.1
82.7%88.8%
BrowseComp
73.2%92.2%
Benchmarks
Gray Swan IPI · k = 1
3.1%
Gray Swan IPI · k = 10
16.3%
Gray Swan IPI · k = 15
20%
ProgramBench
1%
SWE-Bench Verified
79%
DeepSWE 1.1
73%
Next.js Evals
77%
Supabase Evals · with skills
89.9%
Supabase Evals · no skills
75.4%
Frontier-Bench v0.1
34.4%
Terminal-Bench 4.0
37.27%
Toolathlon-Verified
70.3%
BU Bench
67%
CyberGym
76.7%
Humanity's Last Exam · with tools
34.8%
ARC-AGI-2
92.5%
AutomationBench
25.1%
GDPval-AA v2
1748
threejseval
1421
Overview
CompanyDeepSeekOpenAI
Release dateJul 31 2026Jun 26 2026
AccessProprietaryProprietary

Other comparisons

DeepSeek-V4-Flash-0731vsClaude Fable 5.1GPT-5.6 SolvsClaude Fable 5.1DeepSeek-V4-Flash-0731vsGemini 3.8 FlashGPT-5.6 SolvsGemini 3.8 FlashDeepSeek-V4-Flash-0731vsMuse Spark 1.3GPT-5.6 SolvsMuse Spark 1.3DeepSeek-V4-Flash-0731vsGrok 4.6GPT-5.6 SolvsGrok 4.6DeepSeek-V4-Flash-0731vsMistral Medium 3.5GPT-5.6 SolvsMistral Medium 3.5DeepSeek-V4-Flash-0731vsKimi K3GPT-5.6 SolvsKimi K3

Frequently asked questions

GPT-5.6 Sol leads DeepSeek-V4-Flash-0731 on 3 of the 3 benchmarks they both report (BullshitBench v2, Terminal-Bench 2.1, BrowseComp). DeepSeek-V4-Flash-0731 is cheaper on both input and output: $0.22 vs $5.00 per million input tokens, and $0.66 vs $30.00 per million output tokens. Figures are base-tier rates. GPT-5.6 Sol shipped 35 days before DeepSeek-V4-Flash-0731, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, GPT-5.6 Sol leads at 48% vs DeepSeek-V4-Flash-0731 at 39%. On Terminal-Bench 2.1, GPT-5.6 Sol leads at 88.8% vs DeepSeek-V4-Flash-0731 at 82.7%. On BrowseComp, GPT-5.6 Sol leads at 92.2% vs DeepSeek-V4-Flash-0731 at 73.2%.