DeepSeek schakelt oude modellen uit voor V4
DeepSeek trekt vandaag de stekker uit zijn oudere API-modellen. Vanaf 24 juli om 15:59 UTC zijn de aliassen deepseek-chat en deepseek-reasoner niet meer bereikbaar. Wie ze daarna nog aanroept, belandt bij DeepSeek V4. Voor ontwikkelaars die op de oude namen bouwden, is dit het moment om hun code na te lopen.
Wat er vandaag verandert
Tot de deadline routeren beide oude aliassen stil door naar V4-Flash. Daarna verdwijnen ze zonder aangekondigde uitloopperiode, zo staat in de API-documentatie van DeepSeek (samengevat door onder meer Codersera). Wie de modelnaam hard in zijn applicatie heeft gezet, krijgt na 15:59 UTC een foutmelding als hij niets doet. De oplossing is klein: verwijs naar deepseek-v4-pro of deepseek-v4-flash.
DeepSeek bracht V4 in april uit, eerst als preview. De overstap van vandaag maakt V4 in de praktijk het standaardmodel voor iedereen die de klassieke chat- en reasoner-endpoints gebruikte.

V4-Pro en V4-Flash in cijfers
V4 bestaat uit twee open modellen onder MIT-licentie. V4-Pro telt 1,6 biljoen parameters, waarvan er 49 miljard per token actief zijn dankzij een mixture-of-experts-opzet. V4-Flash is met 284 miljard parameters lichter, met 13 miljard actieve parameters. Beide werken met een contextvenster van 1 miljoen tokens en een maximale uitvoer van 384.000 tokens.
De prijzen liggen laag. V4-Pro kost 0,435 dollar per miljoen invoertokens en 0,87 dollar per miljoen uitvoertokens; V4-Flash zit op 0,14 en 0,28 dollar. Op SWE-bench Verified, een test met echte GitHub-problemen, haalt V4-Pro Max 80,6 procent en V4-Flash 79,0 procent. Daarmee komt het dicht bij gesloten topmodellen, tegen een fractie van de kosten.
Onderdeel van een drukke open-weightweek
De timing valt samen met een golf aan open modellen. Moonshot beloofde de volledige gewichten van Kimi K3 op 27 juli, en ook andere Chinese labs schuiven hun releases naar het einde van de maand. AI Feiten schreef eerder dat dit de grootste week ooit voor open AI-modellen dreigt te worden. Kimi K3 klom intussen naar de top bij langdurige taken, terwijl Google met Gemini 3.6 Flash en Meta met Muse Spark 1.1 de druk aan de commerciele kant opvoeren.
Voor DeepSeek is het opruimen van oude endpoints een teken dat het bedrijf zijn aanbod wil vereenvoudigen. Een modelfamilie, twee formaten, open gewichten.
Wat dit betekent
Voor Nederlandse ontwikkelaars en bedrijven die DeepSeek in hun stack hebben, is de boodschap concreet: controleer vandaag nog welke modelnaam je aanroept. Wie op de oude aliassen bleef hangen, draait vanaf vanavond ongemerkt op V4-Flash, wat qua gedrag en prijs anders kan uitpakken dan het oude reasoner-model. Wie bewust wil kiezen, zet de naam expliciet op Pro of Flash.
De bredere les zit in de prijs. Open modellen met een miljoen tokens context en topscores op codeertests kosten nu minder dan een dollar per miljoen tokens. Dat verschuift de rekensom voor iedereen die AI in software inbouwt, en het verklaart waarom de gesloten aanbieders deze maand zo hard aan hun eigen tarieven sleutelen.
