AnalysisAI ModelsJuly 24, 2026

Kimi K3 and Claude Fable 5 compared on DeepSWE coding benchmark

Claude Fable 5 leads with a 1.4-point higher pass@1 score, while Kimi K3 achieves 2.8x more solves per dollar across 452 DeepSWE rollouts.

1 source

Daily brief

Get tomorrow's AI brief in your inbox

More stories today

Open the live feed