Gemini 3.7 Flash toont het tempo van Google’s AI-race
3 mins read

Gemini 3.7 Flash toont het tempo van Google’s AI-race

Google bracht Gemini 3.7 Flash op 13 augustus uit, amper drie weken na versie 3.6. Het is geen groot nieuw model met een eigen persconferentie, maar precies dat maakt het interessant: de Flash-lijn is het onderdeel van Gemini waar Google het hardst aan sleutelt, en de update laat zien hoe die race er inmiddels uitziet.

Winst zonder hogere rekenkosten

Op DeepSWE 1.1, een test waarbij een model zelfstandig bugs opspoort en oplost, gaat de score van 49,0 naar 65,3 procent. FrontierCode 1.1 stijgt van 34,4 naar 43,6 procent. Google zegt dat de winst komt uit algoritmische aanpassingen, niet uit een groter model, wat betekent dat de prijs per aanroep niet vanzelf omhoog gaat. Sterker nog: de introductieprijs van 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens geldt tot en met 31 december 2026 en is met terugwerkende kracht ook op 3.6 Flash toegepast, zo meldde VentureBeat. Vanaf januari 2027 verdubbelen die tarieven.

Softwareontwikkelaar kijkt naar code op twee schermen in een kantoor

Waarom Flash meer aandacht krijgt dan Pro

Het model is beschikbaar via de Gemini API, Google AI Studio, Android Studio, de agentomgeving Antigravity en het Gemini Enterprise Agent Platform. Die brede uitrol past bij een patroon dat ook zichtbaar werd toen Gemini deze maand de grens van 1 miljard maandelijkse gebruikers passeerde: het gaat Google niet langer alleen om het slimste model, maar om een variant die goedkoop genoeg is om in elke agentketen te draaien. Een agent die een taak opsplitst in tien of twintig deelstappen roept een model evenveel keer aan, en dan telt de prijs per token zwaarder mee dan een paar procentpunt extra op een benchmark.

Diezelfde verschuiving is terug te zien bij concurrenten. DeepSeek V4 Pro scoorde eerder deze maand hoog tegen een fractie van de gangbare prijs, Writer beloofde met Palmyra X6 een halvering van de agentkosten, en Anthropic maakte onlangs de introductieprijs van Claude Sonnet 5 blijvend in plaats van tijdelijk. Prijs per token is het nieuwe slagveld geworden, niet alleen de ranglijst.

Niet overal de beste keuze

Onafhankelijke tests, verzameld door onder meer DataCamp, laten zien dat 3.7 Flash niet op elk vlak wint. Op terminalwerk blijft GPT-5.6 Terra sterker, en bij multimodale taken doet Claude Sonnet 5 het beter. Dat is precies waarom Google het model naast Imagen 4 positioneert in plaats van in de plaats ervan: die beeldgenerator kreeg deze week zijn eigen uitrol binnen de Gemini API, terwijl Flash zich concentreert op tekst, code en agentwerk.

Een goedkoper model dat net zo goed werkt op jouw eigen taken levert meer op dan een duurder model met een hogere score op een benchmark die niemand in jouw organisatie gebruikt. Test het op honderd echte voorbeelden voordat je overstapt, niet op de marketingcijfers van de leverancier.

Leon Tindemans, AI-expert en Copilot- & ChatGPT-trainer

Wat betekent dit

Voor bedrijven die nu al met Gemini werken, verandert er weinig aan de manier van integreren, wel aan de rekensom. Wie veel volume draait via Flash, betaalt tot het einde van het jaar de helft van het tarief dat vanaf 2027 geldt, en doet er goed aan die overgang nu al in de begroting mee te nemen. Voor de bredere markt is de release vooral een signaal dat de concurrentie zich verplaatst van het duurste model naar het goedkoopste dat nog goed genoeg is. Meer achtergrond over de modelreeks staat op de cornerstone-pagina over Gemini 3.7 Flash.