De AI-strijd verschuift naar de goedkope modellen
2 mins read

De AI-strijd verschuift naar de goedkope modellen

Wie de grote AI-labs deze zomer volgt, ziet het accent verschuiven. Niet het duurste topmodel trekt de aandacht, maar de goedkope tier eronder, waar de meeste productietaken echt draaien. In het nieuwsoverzicht van 22 juli van buildfastwithai wordt die verschuiving met zoveel woorden benoemd: het zwaartepunt van de concurrentie beweegt van de frontier-modellen naar het high-volume segment.

De prijzen kruipen naar elkaar toe

De cijfers laten zien hoe dicht de aanbieders op elkaar zitten. Google zette op 21 juli Gemini 3.6 Flash neer voor 1,50 dollar per miljoen invoertokens en 7,50 dollar voor uitvoer. OpenAI vraagt voor Luna, de snelste variant van GPT-5.6 in drie smaken, 1 dollar en 6 dollar. Grok 4.5 van xAI staat op 2 dollar en 6 dollar. Dat blijkt uit de prijsvergelijkingen van aipricing.guru en het releaseoverzicht van ThursdAI. Open modellen duiken daar met hun kosten nog onder.

Het verschil tussen deze modellen is voor veel toepassingen klein geworden. Voor een chatbot, een samenvatting of een routinematige agent haalt de goedkoopste optie vaak al ruim voldoende kwaliteit. De keuze gaat dan niet langer over het slimste antwoord, maar over de rekening aan het eind van de maand.

Ontwikkelaar werkt in de avond aan een laptop met AI-toepassingen

Waarom het volume-segment nu telt

De reden is simpel: bedrijven draaien in de praktijk miljoenen kleine taken, geen handjevol zware. Zodra een AI-toepassing van pilot naar productie gaat, tikt elke token aan. Een model dat per miljoen tokens een paar dollar goedkoper is, scheelt bij die schaal serieus geld. Dat verklaart ook de golf investeringen in efficiënte inferentie, zoals de ronde waarmee Fireworks AI 1,5 miljard ophaalde voor goedkope inferentie.

Google versterkt de trend zichtbaar. Het bedrijf bracht in juli drie Flash-varianten uit terwijl het aangekondigde topmodel Gemini 3.5 Pro bleef schuiven. Tegelijk begon Google aan de training van een nieuw topmodel als Gemini 4. De boodschap: aan de top wordt nog volop gebouwd, maar het geld wordt in de brede laag verdiend.

Wat het betekent voor gebruikers

Voor ontwikkelaars en bedrijven is dit gunstig nieuws. De kosten per taak dalen hard, en de keuze wordt breder. Het maakt inmiddels minder uit welk merk erop staat; de tarieven en de beschikbaarheid wegen zwaarder. Die verschuiving voedt ook de prijzenoorlog om goedkope agents, waarin aanbieders elkaar op prijs proberen af te troeven.

De keerzijde is dat het onderscheid tussen de labs vervaagt. Wie zijn model niet duidelijk beter of goedkoper maakt, verdwijnt in de ruis. Voor wie AI gebruikt is dat vooral prettig: meer capaciteit voor minder geld, en de vrijheid om per taak het passende model te kiezen in plaats van vast te zitten aan één leverancier.