GPT-6.1 Sol vs Claude Opus 5.5: Pricing Matters

Benchmarks

BenchmarkGPT-6.1 SolClaude Opus 5.5Difference
GDP.pdf32.0%High effort28.8%High effortGPT-6.1 Sol +3.2 points
AutomationBench 1.0.636.1%Max effort42.5%Max effortOpus +6.4 points
AutomationBench 1.0.631.7%Medium effort29.5%Medium effortGPT-6.1 Sol +2.2 points
Terminal-Bench Science 0.157.0%Max effort63.3%Max effortOpus +6.3 points

Artificial Analysis benchmarks

BenchmarkGPT-6.1 Sol (Max)Claude Opus 5.5 (Max)Difference
Intelligence Index v4.3.251.857.6Opus +5.8
AA-Briefcase v1.11564.2 Elo1822 EloOpus +257.8 Elo
GDPval-AA v2.11575.1 Elo1846 EloOpus +270.9 Elo
AutomationBench-AA64.9%70%Opus +5.1 points
Terminal-Bench 4.056.1%60%Opus +3.9 points
SciCode54.2%67%Opus +12.8 points
Humanity's Last Exam52.9%61%Opus +8.1 points
GDP.pdf31.0%26%GPT-6.1 Sol +5.0 points
CritPt31.7%32%Opus +0.3 points
AA-Omniscience41.546Opus +4.5
AA-LCR v1.183.0%85%Opus +2.0 points

Cost and efficiency

MetricGPT-6.1 Sol (Max)Claude Opus 5.5 (Max)Difference
Intelligence Index51.857.6Opus +5.8
Cost per Intelligence Index task$0.72$5.98Sol about 88% cheaper
Output tokens across the indexAbout 67MAbout 260MSol uses about 74% fewer
Input, per 1M tokens$2$4Sol 50% cheaper
Output, per 1M tokens$10$20Sol 50% cheaper
Cached input, per 1M tokens$0.10$0.20Sol 50% cheaper

Pricing and specs

SpecificationGPT-6.1 SolClaude Opus 5.5Difference
Input, per 1M tokens$2$4Sol 50% cheaper
Cached input, per 1M tokens$0.10$0.20Sol 50% cheaper
Output, per 1M tokens$10$20Sol 50% cheaper
Context window1.05M tokens1M tokensSol +50K tokens
Max output128K tokens128K tokensSame
Reasoning levelsLow to MaxAdaptive reasoning, effort levelsBoth adjustable