Prijzenoorlog om goedkope AI-agents barst los
2 mins read

Prijzenoorlog om goedkope AI-agents barst los

De concurrentie tussen AI-labs verschuift dit jaar van pure rekenkracht naar de prijs per token. Waar bedrijven een jaar geleden nog fors betaalden voor een topmodel, kost een agent die dezelfde klus klaart nu een fractie daarvan. Drie recente releases laten zien hoe hard die bodem zakt.

Anthropic zet de toon met Claude Sonnet 5

Anthropic maakte Claude Sonnet 5 op 30 juni het standaardmodel voor gratis- en Pro-gebruikers. Volgens TechCrunch rekent het bedrijf tot 31 augustus 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens, waarna het tarief naar 3 en 15 dollar gaat. De inzet is helder: prestaties dicht bij Opus 4.8, tegen een deel van de kosten. Op een benchmark voor agentisch programmeren haalt Sonnet 5 63,2 procent, tegen 69,2 procent voor Opus 4.8. Voor veel bedrijfstaken is dat gat klein genoeg om voor het goedkopere model te kiezen. Wij schreven eerder dat Claude Sonnet 5 agents fors goedkoper draait.

Klein team overlegt met laptops aan een tafel in een licht kantoor

OpenAI en open modellen drukken de prijs verder

OpenAI zette op 9 juli de GPT-5.6-familie neer met drie lagen. Volgens OpenAI kost Terra 2,50 dollar invoer en 15 dollar uitvoer per miljoen tokens, terwijl Luna op 1 en 6 dollar zit. Het vlaggenschip Sol is met 5 en 30 dollar duurder, maar mikt op langlopend agentwerk. Dat Sol inmiddels tot 750 tokens per seconde op Cerebras haalt, laat zien dat snelheid net zo goed een verkoopargument wordt als prijs.

Uit China komt extra druk. Moonshot AI bracht op 16 juli Kimi K3 uit, dat volgens VentureBeat 3 dollar invoer en 15 dollar uitvoer per miljoen tokens rekent, met 30 cent per miljoen tokens bij een cache-treffer. Het grootste open model tot nu toe is bovendien gratis te draaien op eigen hardware. Ook xAI voert de druk op met Grok 4.5, dat minder tokens verbruikt per taak, wat de effectieve rekening nog verder verlaagt.

Wat dit betekent

Voor Nederlandse bedrijven die agents inzetten voor coderen of klantcontact verandert de rekensom. Een model dat vorig jaar te duur was voor productie, past nu binnen een normaal IT-budget. De keuze gaat minder over welk lab het slimste model heeft en meer over welke combinatie van prijs en snelheid past bij de taak, en of het model betrouwbaar genoeg is. Ook Google mengt zich met Gemini 3.5 Pro in dit gevecht. Wie nu een agent bouwt, doet er goed aan de tarieven per kwartaal opnieuw te wegen, want tijdelijke kortingen zoals die van Anthropic lopen af. De bodem is nog niet bereikt.