Compare AI models

Benchmarks
SWE-Bench Verified
49%77.4%
Overview
CompanyAnthropicMeta
Release dateOct 22 2024Apr 8 2026
AccessClosedClosed
Model detailsView modelView model

Frequently asked questions

Muse Spark leads Claude 3.5 Sonnet (upgraded) on 1 of the 1 benchmark they both report (SWE-Bench Verified). Claude 3.5 Sonnet (upgraded) shipped 533 days before Muse Spark, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On SWE-Bench Verified, Muse Spark leads at 77.4% vs Claude 3.5 Sonnet (upgraded) at 49%.