Claude Opus vs Sonnet Pricing SWE-bench: Why the Cheaper Model Wins on Coding
You’ve been told Claude Opus 4.6 is the best coding AI. The benchmarks agree—except when they don’t. Claude’s own published results show Sonnet 4.6 resolves more real GitHub issues than Opus 4.6 on SWE-bench Verified (82.1% vs 80.8%) while costing five times less per input token ($3 vs $15 per million). This isn’t a rounding