Google halveert prijs van Gemini 3.7 Flash
3 mins read

Google halveert prijs van Gemini 3.7 Flash

Google heeft op 13 augustus Gemini 3.7 Flash uitgebracht, drie weken na de vorige Flash-versie. De prijs is het opvallendste deel van de aankondiging: tot en met 31 december 2026 betalen ontwikkelaars 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens. Dat is de helft van de lijstprijs, die per 1 januari 2027 op 1,50 en 7,50 dollar komt te liggen.

Wat er beter werd

Google positioneert het model voor programmeerwerk, agentische taken en documentverwerking in bedrijven. De sprong zit vooral in de codebenchmarks. Op DeepSWE v1.1, een test waarin een model bugs opspoort en issues in echte repositories oplost, gaat de score van 49,0 naar 65,3 procent. FrontierCode 1.1 stijgt van 34,4 naar 43,6 procent en AutomationBench bijna verdubbelt, van 17,0 naar 30,4 procent. De doorvoersnelheid ligt rond 340 tokens per seconde, ruim onder de 750 tokens per seconde die OpenAI met Ultrafast haalt, maar tegen een fractie van de kosten.

VentureBeat wijst erop dat de winst uit algoritmische verbeteringen komt en niet uit een groter model. Google zelf noemt 3.7 Flash zijn meest intelligente werkpaard voor code en agents. Dat is marketingtaal, en de cijfers laten ook zien waar het model tekortschiet: volgens de vergelijking bij Trending Topics ligt GPT-5.6 Terra voor op Terminal-bench en blijft Claude Sonnet 5 sterker op multimodale taken.

Twee collega's overleggen bij een glazen wand met een tablet

Waar je het model kunt gebruiken

Het model draait via de Gemini API, Google AI Studio en Android Studio, in de agentomgeving Antigravity, op het Gemini Enterprise Agent Platform en in Gemini Spark voor abonnees van Google AI Pro en Ultra in ruim 160 landen. De tijdelijke korting geldt met terugwerkende kracht ook voor Gemini 3.6 Flash, wat de overstap voor bestaande projecten goedkoper maakt. Google zet de Flash-lijn daarmee neer als standaardkeuze voor werk dat in volume draait, terwijl de zwaardere Pro-modellen de uitzondering blijven. Eerder liet het bedrijf al zien hoe ver het die richting doortrekt met Gemini die lokaal op de Pixel 11 draait.

Prijzen bewegen twee kanten op

De timing is niet toevallig. Terwijl Google en OpenAI hun tarieven verlagen, gaat DeepSeek per 17 augustus juist omhoog met de API-prijzen tijdens piekuren. Datzelfde bedrijf zette een dag voor Google’s aankondiging V4 Pro zonder ophef algemeen beschikbaar. De goedkope middenklasse is het strijdtoneel geworden, niet de top van de benchmarklijstjes.

Wat betekent dit

Voor teams die AI-agents in productie draaien, verandert de rekensom. Een agent die tientallen keren per taak een model aanroept, loopt hard op tegen de kosten per token. Halveert die prijs en stijgt tegelijk het percentage taken dat in één keer goed gaat, dan daalt de totale rekening dubbel. Wel is de korting tijdelijk: wie nu op 0,75 dollar begroot, moet vanaf januari met het dubbele rekenen. Het loont om de komende maanden te meten hoeveel handmatig nawerk en hoeveel herhaalde aanroepen er echt wegvallen, want dat cijfer bepaalt of het model in 2027 tegen volle prijs nog rendeert.