Compare AI models

Specifications
Parameters
253B—
Context window
—128k
API pricing
Input price
—$0.15
Output price
—$0.60
Cached input price
—$0.075
Cheapest input
—$0.15Azure
Cheapest output
—$0.60Azure
Benchmarks
GPQA Diamond
76%40.2%
Overview
CompanyNVIDIAOpenAI
Release dateApr 8 2025Jul 18 2024
AccessOpen WeightClosed
Model detailsView modelView model

Frequently asked questions

Llama Nemotron Ultra 253B leads GPT-4o mini on 1 of the 1 benchmark they both report (GPQA Diamond). Only GPT-4o mini has a verified first-party API price: $0.15 per million input tokens and $0.60 per million output tokens. No pay-as-you-go API rate is tracked for Llama Nemotron Ultra 253B. GPT-4o mini shipped 264 days before Llama Nemotron Ultra 253B, so benchmark comparisons should account for the intervening progress.

Llama Nemotron Ultra 253B is open weight, while GPT-4o mini is closed.

On GPQA Diamond, Llama Nemotron Ultra 253B leads at 76% vs GPT-4o mini at 40.2%.