
Moonshots Kimi K3 erreicht als erstes chinesisches Modell die Spitze der Code Arena: Frontend und schlägt Claude Fable 5 sowie GPT-5.6 Sol deutlich. Bei anspruchsvoller Mathematik zeigt sich jedoch eine klare Lücke: Im FrontierMath-Benchmark erreicht K3 nur 39 Prozent, westliche Spitzenmodelle schaffen fast 90 Prozent.
Der Artikel Moonshot’s Kimi K3 beats Fable 5 at frontend code but falls far behind in advanced math erschien zuerst auf The Decoder.
