DeepSeek verhoogt API-prijzen fors vanaf 17 augustus
3 mins read

DeepSeek verhoogt API-prijzen fors vanaf 17 augustus

DeepSeek gaat vanaf 17 augustus fors meer rekenen voor toegang tot zijn V4-modellen. Het Chinese AI-bedrijf voert tegelijk een tariefstructuur in met piek- en daluren, iets wat in de LLM-markt tot nu toe ongebruikelijk was. Reuters meldt dat de nieuwe tarieven tussen de 50 en 1.100 procent boven de huidige prijzen liggen, afhankelijk van het model, het type token en het tijdstip.

Wat er precies verandert

Volgens TechNode, dat de aangepaste prijspagina van DeepSeek doornam, gelden piekuren van 9.00 tot 12.00 uur en van 14.00 tot 18.00 uur Pekingtijd. Omgerekend naar onze tijdzone valt dat grofweg tussen 3.00 en 6.00 uur en tussen 8.00 en 12.00 uur. Buiten die blokken betaal je de helft.

Voor DeepSeek-v4-pro komt de outputprijs tijdens piekuren op 27 yuan per miljoen tokens, met 13,5 yuan daarbuiten. Input zonder cachetreffer gaat naar 9 yuan tijdens de piek. Het goedkopere v4-flash zit op 9 yuan output tijdens piekuren en 3 yuan voor cache-misses. Tot nu toe rekende DeepSeek een vast tarief van 0,435 dollar per miljoen inputtokens en 0,87 dollar voor output bij V4 Pro, wat het model tot een van de goedkoopste in zijn klasse maakte.

Gang met serverracks in een datacenter bij nacht

Capaciteit als echte reden

DeepSeek zegt de prijzen aan te passen om middelen beter te verdelen. Dat is bedrijfstaal voor een simpeler probleem: de vraag naar rekenkracht overtreft het aanbod, en met exportbeperkingen op geavanceerde chips kan het bedrijf niet zomaar bijkopen. Een tarief dat overdag pijn doet en ’s nachts meevalt duwt batchwerk naar de uren waarin de GPU’s toch stilstaan. Nutsbedrijven doen dit al decennia met stroom.

De timing valt op. Het bedrijf zette build 0813 van V4 Pro deze week zonder aankondiging in algemene beschikbaarheid, met een miljoen tokens contextvenster en sterke scores op agenttaken. Vier dagen later gaat de prijs omhoog. Wie het model op basis van de previewtarieven in productie nam, krijgt dus een rekening die er anders uitziet dan de businesscase.

Gevolgen voor ontwikkelaars

Prijs was het belangrijkste argument om voor DeepSeek te kiezen. Op agentbenchmarks komt V4 Pro in de buurt van westerse topmodellen, maar het echte verschil zat in de kosten per miljoen tokens. Dat gat wordt smaller. OpenAI schoof de concurrentie recent naar een andere as door GPT-5.6 Sol op 750 tokens per seconde te zetten, en ook daar telt doorvoer zwaarder dan de sticker.

Voor teams die veel input hergebruiken blijft er een uitweg: de cachetreffer kost bij v4-pro 0,30 yuan per miljoen tokens tijdens de piek, een fractie van een cache-miss. Wie zijn prompts zo bouwt dat het vaste deel voorop staat, houdt de rekening beheersbaar. De andere route is zelf hosten met open gewichten, al blijkt bij Qwen3.8 dat aangekondigde gewichten niet altijd meteen online staan, en heb je alsnog GPU-capaciteit nodig.

Wat betekent dit

De fase waarin Chinese aanbieders marktaandeel kochten met verliesgevende tarieven loopt op zijn eind. DeepSeek verkoopt nu schaarste in plaats van volume, en de klant kiest zelf of hij daarvoor betaalt of zijn workload verplaatst. Reken je met AI-kosten in je product, plan dan een herberekening in voor komende week en kijk waar je jobs echt draaien moeten.