Nieuws

Moonshot's Kimi K3 presteert beter in frontend-code dan Fable 5, maar blijft ver achter bij complexe wiskunde

Moonshot's AI-model Kimi K3 is het eerste Chinese model dat de top van de Code Arena: Frontend-ranglijst bereikt, met een score van 1.679 punten, waarmee het Claude Fable 5 (1.631) en GPT-5.6 Sol (1.618) verslaat. Op het gebied van geavanceerde wiskunde presteert Kimi K3 echter aanzienlijk slechter: het haalt slechts ongeveer 39 procent op FrontierMath Tier 4, terwijl modellen van OpenAI en Anthropic bijna 90 procent scoren.

Bron: The Decoder

Originele taal: [en-US]

Lees hier het originele artikel

Dossier: