Claude Sonnet 5.5 vs Claude Opus 5.5: Near Opus Level

Anthropic has officially announced Claude Sonnet 5.5 with a significant upgrade over Sonnet 5 and near Opus 5.5 level performance. Here is how Claude Sonnet 5.5 compares against the recently announced Opus 5.5:

Benchmarks

BenchmarkClaude Sonnet 5.5Claude Opus 5.5Difference
Terminal-Bench 4.070.6%66.4%Sonnet +4.2 points
FrontierCode 1.1 (Main)52.1%Xhigh effort. 46.2% at Max54.4%Opus +2.3 pointsvs Sonnet at Xhigh
CursorBench 4.055.5%57.8%Opus +2.3 points
SWE-Bench Pro81.3%89.9%Opus +8.6 points
SWE-Bench Multilingual90.3%93.9%Opus +3.6 points
SWE-Bench Multimodal54.3%61.4%Opus +7.1 points
GDPval-AA v2.11844 Elo1846 EloOpus +2 Elo
AA-Briefcase v1.11811 Elo1822 EloOpus +11 Elo
Humanity's Last Exam, with tools64.5%67.7%Opus +3.2 points
Humanity's Last Exam, no tools56.9%64.4%Opus +7.5 points
AutomationBench, Zapier44.7%42.5%Sonnet +2.2 points
HealthBench Professional69.2%65.6%Sonnet +3.6 points
Terminal-Bench-Science 0.159.9%58.7%Sonnet +1.2 points
FrontierSWE v2, Proximal61.9%62.3%Opus +0.4 points
ProgramBench, long context79.7%91.2%Opus +11.5 points
ArXivMath Aug. 2026, with tools95.2%96.9%Opus +1.7 points
ArXivMath Aug. 2026, no tools86.8%91.2%Opus +4.4 points
OSWorld 2.1, partial credit80.1%81.8%Opus +1.7 points
OSWorld 2.1, strict pass43.5%48.7%Opus +5.2 points
Chartography, no tools61.6%64.4%Opus +2.8 points

Artificial Analysis benchmarks

BenchmarkClaude Sonnet 5.5Claude Opus 5.5Difference
Intelligence Index v4.3.25658Opus +2
AA-Briefcase v1.11811 Elo1822 EloOpus +11 Elo
GDPval-AA v2.11844 Elo1846 EloOpus +2 Elo
AutomationBench-AA71%70%Sonnet +1 point
Terminal-Bench 4.064%60%Sonnet +4 points
SciCode61%67%Opus +6 points
Humanity's Last Exam55%61%Opus +6 points
CritPt, physics31%32%Opus +1 point
AA-Omniscience3246Opus +14
AA-LCR v1.1, long context83%85%Opus +2 points