Claude Sonnet 5.5 vs Opus 5.5 vs GPT-6.1 Sol
Claude Sonnet 5.5 edged Claude Opus 5.5 on our general-programming benchmark, a payments app, 0.7984 to 0.7926, a margin I read as level. It built the better app, though: it earned 0.9894 to Opus's 0.
leanzero.hashnode.dev67 min read