AnalysisAI ModelsJuly 24, 2026

Kimi K3 vs Claude Fable 5 on DeepSWE: Cost and Coding

In 452 DeepSWE rollouts, Claude Fable 5 leads pass@1 69.9% to 68.5%, but open-weight Kimi K3 wins pass@4 (89.4% vs 88.5%) and solves 2.8x more tasks per dollar ($4.65 vs $13.41 per rollout). Fable 5 is more reliable, solving 58 tasks four-for-four vs 45.

2 sources

Daily brief

Get tomorrow's AI brief in your inbox

More stories today

Open the live feed