DeepSeek houdt V4 Pro toch in de lucht
DeepSeek draait zijn eigen aankondiging terug. Het Chinese AI-lab zou vanaf 14 september 04:00 UTC alle verkeer naar het model deepseek-v4-pro doorsturen naar de nieuwe V4.1 Flash, maar die datum is verstreken zonder dat het gebeurde. In de changelog van de API-documentatie staat nu dat DeepSeek besloten heeft de dienstverlening voor V4 Pro na 14 september 2026 voort te zetten, met ongewijzigde facturering. Reden: vraag van gebruikers.
Drie mails in twee dagen
De aanloop was rommelig. DeepSeek stuurde API-klanten vanaf 9 september drie berichten in nog geen twee etmalen. Eerst de aankondiging dat V4.1 Flash op 10 september zou landen en dat het model V4 Pro op alle belangrijke meetpunten voorbij zou zijn. Daarna de mededeling dat verzoeken aan V4 Pro zouden worden omgeleid naar Flash, tegen de lagere Flash-tarieven. En vervolgens de terugtrekking. Wij schreven eerder over de oorspronkelijke vervanging van V4 Pro door V4.1 Flash.
Het prijsverschil verklaart waarom DeepSeek dacht klanten een plezier te doen. V4.1 Flash begint bij 0,15 dollar per miljoen invoertokens buiten de piekuren, tegen 0,66 dollar voor V4 Pro op een cache miss, en het dubbele tijdens piekuren op weekdagochtenden UTC. Dat is een forse verlaging voor wie puur op tokenprijs stuurt.

Waarom ontwikkelaars terugduwden
Een goedkoper model met betere scores is nog geen gelijkwaardig model. Promptformats, de manier waarop een model tools aanroept en de toon van de uitvoer verschillen per versie. Wie een klantenservicebot in productie heeft draaien die maandenlang op V4 Pro is afgesteld, wil zelf bepalen wanneer de migratie plaatsvindt. Dat ongemak speelt breder: bedrijven klagen al langer over het releasetempo van de AI-labs, en ook de Agents API van OpenAI loopt tegen praktische bezwaren aan.
Benchmarks maken het beeld gemengder dan de aankondiging suggereerde. The Next Web noteert DeepSeeks eigen cijfers voor V4.1 Flash: 74,2 op DeepSWE v1.1 en 88,1 op CyberGym, maar 36,8 op Humanity’s Last Exam tegenover 56,3 voor Opus 5 en 20,3 op ProgramBench tegenover 37,0. Op redeneertaken zit er dus een gat. Dat sluit aan bij eerder onderzoek waaruit blijkt dat frontier-modellen struikelen over echte bedrijfscode.
Wat V4.1 Flash wel biedt
Het nieuwe model draait onder de modelnaam deepseek-flash en heeft native multimodaal visueel begrip. Volgens DeepSeek telt V4.1 Flash 552 miljard parameters, waarvan er 8 miljard actief zijn bij het lezen van invoer en 16 miljard bij het genereren van uitvoer. De oudere namen deepseek-v4-flash en deepseek-v4-flash-vision-exp worden tijdelijk doorgestuurd naar V4.1 Flash. Die twee zijn wel echt met pensioen.
Wat betekent dit
Voor iedereen die een AI-model in een productiesysteem gebruikt is dit een nuttige herinnering: een API-endpoint is geen garantie. Leg vast welke modelversie je aanroept, test nieuwe versies in een aparte omgeving en houd rekening met een uitfaseringsmail. Dat DeepSeek binnen enkele dagen bijdraaide laat zien dat klantdruk werkt, zeker bij een lab dat toewerkt naar een beursgang in Shanghai en zijn zakelijke gebruikers hard nodig heeft.
