Google lanceert Gemini 3.6 Flash, goedkoper dan 3.5
Google heeft op 21 juli Gemini 3.6 Flash uitgebracht, samen met Gemini 3.5 Flash-Lite en een op beveiliging afgestemde variant, Gemini 3.5 Flash Cyber. Opvallend detail: het nieuwe model is goedkoper dan zijn voorganger. Dat schrijven onder meer 9to5Google en MarkTechPost. De release valt in een periode waarin het snellere, goedkopere segment van de markt hard groeit.
Wat Gemini 3.6 Flash kan
Het model zit in de zogeheten Flash-laag, boven Flash-Lite en onder de duurdere Pro-versie. Google positioneert het voor agenttaken en multimodaal werk, waarbij snelheid en redeneervermogen samenkomen. De thinking-modus staat standaard aan en het contextvenster telt ruim een miljoen tokens, met een maximale uitvoer van 65.536 tokens. De kennisdrempel schuift op naar maart 2026.
Op de benchmarks laat Google verbetering zien bij code en computergebruik. Volgens de cijfers die 9to5Google noemt gaat DeepSWE van 37 naar 49 procent en MLE Bench van 49,7 naar 63,9 procent. Bij OSWorld-Verified, een test voor het bedienen van een computer, stijgt de score van 78,4 naar 83 procent. Volgens Artificial Analysis verbruikt Gemini 3.6 Flash daarbij 17 procent minder uitvoertokens dan Gemini 3.5 Flash.
Lagere prijs voert de concurrentie op

De prijs is de kern van dit verhaal. Gemini 3.6 Flash kost 1,50 dollar per miljoen invoertokens en 7,50 dollar per miljoen uitvoertokens. De vorige Flash rekende nog 9 dollar voor uitvoer, dus de nieuwe versie is zowel beter als goedkoper. Cryptobriefing noemt dat een verscherping van de prijzenslag tussen de grote aanbieders. Wie veel API-verkeer draait, merkt zo’n verlaging direct in de rekening, en dat is precies het slagveld waar ook Kimi K3 en andere agentmodellen zich op richten. Die druk op de tarieven speelt ook mee in de nervositeit rond AI-aandelen van de afgelopen dagen.
Beide nieuwe modellen zijn meteen te gebruiken via de Gemini-app en Search. Ontwikkelaars kunnen erbij via Google Antigravity, AI Studio en Android Studio.
Pro laat op zich wachten, Gemini 4 in de maak
De Flash-release komt terwijl de vlaggenschipversie juist vertraging oploopt. Gemini 3.5 Pro blijft in besloten test bij partners en verschijnt volgens Google pas breder “zodra het klaar is”. Eerder miste Gemini 3.5 Pro al een deadline na tegenvallende resultaten bij code en langlopend redeneren. Tegelijk laat Google weten dat het DeepMind-team is begonnen aan wat het zijn ambitieuste pre-trainingsronde tot nu toe noemt, voor Gemini 4. Details ontbreken nog.
De timing valt samen met groeiende aandacht van toezichthouders. In Washington ligt een voorstel op tafel voor een reviewperiode van 30 dagen voordat nieuwe frontier-modellen breed uitkomen.
Wat betekent dit
Voor gebruikers en bedrijven verschuift de rekensom. Een model dat beter presteert, minder tokens verbruikt en minder kost per miljoen tokens maakt AI-toepassingen op schaal betaalbaarder, zeker voor agentworkflows die veel aanroepen doen. Google kiest ervoor om het middensegment aan te scherpen terwijl het topmodel nog niet af is. Voor concurrenten betekent het dat de prijs van bruikbare AI opnieuw omlaag gaat, en dat de strijd voorlopig net zo hard om kosten per token draait als om ruwe prestaties.
