# Supabase Evals (no skills) — AI model rankings

The same Supabase scenarios, but with none of Supabase's skills loaded — so it measures what the model already knows about building on Supabase, rather than how well it follows Supabase's supplied instructions. Higher is better.

Scores from [Supabase Evals](https://supabase.com/evals), which runs the benchmark and publishes the full field.

6 tracked models have a published Supabase Evals (no skills) score. Higher is better. Scores are gathered from Supabase Evals; recorded retrieval dates appear beside the scores.

## Ranking

| Rank | Model | Developer | Score | Source | Released |
| --- | --- | --- | --- | --- | --- |
| 1 | Claude Opus 5 | Anthropic | 89.9% | [Supabase Evals](https://supabase.com/evals) | Jul 24 2026 |
| 2 | Claude Sonnet 5 | Anthropic | 79.7% | [Supabase Evals](https://supabase.com/evals) | Jun 30 2026 |
| 3 | Kimi K3 | Moonshot AI | 78.3% | [Supabase Evals](https://supabase.com/evals) | Jul 16 2026 |
| 4 | GPT-5.6 Sol | OpenAI | 75.4% | [Supabase Evals](https://supabase.com/evals) | Jun 26 2026 |
| 5 | GPT-5.6 Luna | OpenAI | 60.9% | [Supabase Evals](https://supabase.com/evals) | Jun 26 2026 |
| 6 | GPT-5.4 mini | OpenAI | 55.1% | [Supabase Evals](https://supabase.com/evals) | Mar 17 2026 |


---

Canonical page: https://aireleasetracker.com/benchmark/supabase-evals-no-skills
Full dataset: https://aireleasetracker.com/llms-full.txt · JSON: https://aireleasetracker.com/models.json
Source: AI Release Tracker (https://aireleasetracker.com). Most benchmark scores come from lab launch material; gathered results identify the leaderboard that published them.
