Codeermodellen
Frontier-modellen falen op echte bedrijfscode
Benchmark Real-SWE test AI-codeermodellen op private productiecode van drie bedrijven. Fable 5.1 wint met 38,8 procent, GPT-5.6 Sol blijft op 16,2 procent steken.
GLM-5.2 zet Chinese open modellen op de kaart
Z.ai brengt met GLM-5.2 een open-weights model uit dat Amerikaanse frontier-modellen op codeerbenchmarks nadert, voor een fractie van de kosten. Wat betekent dat voor de markt?
Claude Fable 5 haalt 80 procent op SWE-Bench Pro
Anthropic brengt Claude Fable 5 uit: 80,3 procent op SWE-Bench Pro, sterker in vision en lange context, maar twee keer zo duur als Opus 4.8.
