DeepSeek brengt V4 Flash officieel uit tegen bodemprijs
3 mins read

DeepSeek brengt V4 Flash officieel uit tegen bodemprijs

DeepSeek heeft de definitieve versie van V4 Flash vrijgegeven. Dat gebeurde zonder groot evenement, via een update in de ontwikkelaarsdocumentatie. Het Chinese lab, dat begin 2026 de markt opschudde met goedkope modellen, positioneert V4 Flash als zijn nieuwe werkpaard. Volgens Caixin Global komt het model met sterkere agent-functies en opnieuw lagere API-prijzen. De veelbesproken V4 Pro-variant liet DeepSeek voorlopig achterwege, iets achter op het eigen streven van half juli.

Prestaties dicht bij de top

De architectuur van V4 Flash is identiek aan de preview die DeepSeek in april toonde. Alle vooruitgang komt uit uitgebreide post-training, aldus het bedrijf in zijn documentatie. Zonder de onderliggende opzet aan te passen is het model dus verder getraind op betere data en beloningssignalen. Op tests voor complexe codeer- en agenttaken zit het volgens Nikkei Asia dicht bij Claude Opus 4.8 van Anthropic, een van de sterkste systemen op de markt. Dat is opmerkelijk voor een model dat als open gewicht draait en een fractie van de kosten rekent. De preview stond zeven weken op rij bovenaan bij de meest gebruikte modellen op OpenRouter, meldt Axios. Die opmars past bij de open-weights modellen die de top naderen.

Prijs als wapen

Op OpenRouter staat V4 Flash genoteerd op ongeveer 0,09 dollar per miljoen invoertokens en 0,18 dollar per miljoen uitvoertokens. Ter vergelijking: voor dezelfde hoeveelheid uitvoer die bij Opus 4.8 rond de 25 dollar kost, betaal je bij DeepSeek zo’n 28 cent. Axios noemt dat een race naar nul. Onder de motorkap zit een Mixture-of-Experts-model met 284 miljard parameters, waarvan er 13 miljard tegelijk actief zijn, met een contextvenster rond een miljoen tokens. Die opzet houdt de rekenkosten laag, want per verzoek draait maar een klein deel van het netwerk.

Ontwikkelaar typt op een mechanisch toetsenbord in de avond, monitor onscherp op de achtergrond

De timing versterkt een beweging die al maanden loopt. Eind juli verlaagde OpenAI de prijzen van GPT-5.6, met de Luna-variant die 80 procent zakte. DeepSeek zet daar nu een prijs bovenop die westerse aanbieders lastig kunnen volgen zonder verlies te draaien. Het bedrijf bouwt voort op de eerdere V4 Flash-update van eind juli, die het model al aanscherpte voor code en agents.

Wat dit betekent

Goedkope en capabele modellen halen agenttoepassingen binnen bereik die eerder te duur waren om te draaien. Voor de grote Amerikaanse labs groeit de druk, want klanten kijken steeds vaker naar de prijs per taak, minder naar de allerhoogste benchmarkscore. DeepSeek liet met de preview al zien dat een goedkoop model maandenlang de meest gebruikte kan blijven. Dat V4 Pro nog niet klaar is, laat zien dat ook DeepSeek tegen grenzen aanloopt bij het bouwen van een echt topmodel. Voor bedrijven die nu kiezen verschuift de afweging van of een goedkoop model goed genoeg is naar hoe lang de dure modellen hun meerprijs nog waard zijn. De officiele V4 Flash is genoeg om de bredere prijzenoorlog verder aan te wakkeren.