Gemini 3.6 Flash: goedkoper en beter met Computer Use
Google DeepMind bracht op 21 juli Gemini 3.6 Flash uit, het nieuwe werkpaardmodel van het bedrijf. Volgens 9to5Google verscheen het samen met Gemini 3.5 Flash-Lite en een securityvariant, Gemini 3.5 Flash Cyber. De boodschap is simpel: sneller werk voor minder geld, en een agent die zelf een computer kan bedienen.
Minder tokens, lagere prijs
Google zegt dat 3.6 Flash 17 procent minder output-tokens verbruikt dan 3.5 Flash bij vergelijkbaar werk. De outputprijs zakt daardoor van 9,00 naar 7,50 dollar per miljoen tokens, terwijl de input op 1,50 dollar blijft (9to5Google). Flash-Lite is nog goedkoper, met 0,30 dollar input en 2,50 dollar output. Beide modellen houden een contextvenster van een miljoen tokens vast, met een maximale output van 64.000 tokens.
Die prijsdruk past bij een bredere beweging in de markt. Ook rivalen laten de kosten per token dalen, iets wat we eerder zagen toen Kimi K3 in een blinde codetest Claude versloeg.
Computer Use zit er standaard in
Nieuw is dat Computer Use nu een ingebouwde tool is, aan de clientkant te gebruiken via de Gemini API en Gemini Enterprise. Daarmee kan het model schermen lezen, klikken en formulieren invullen zoals een mens dat doet. Op de OSWorld-Verified-test, die dit soort computerwerk meet, gaat de score van 78,4 naar 83,0 procent (Google DeepMind). Dat telt nu bedrijven agents inzetten die taken van begin tot eind afmaken. De Franse toezichthouder waarschuwde recent nog dat de agentmarkt sterk geconcentreerd raakt.

Sterker in code en onderzoek
Google noemt ook forse sprongen op andere tests. Op de DeepSWE-codebenchmark gaat 3.6 Flash van 37 naar 49 procent, op MLE Bench van 49,7 naar 63,9 procent. De kennisdrempel schuift op van januari 2025 naar maart 2026. Het aparte securitymodel 3.5 Flash Cyber richt zich op het vinden van kwetsbaarheden, een taak waar ook Sakana AI met Fugu-Cyber op mikt. De filosofie lijkt op wat OpenAI doet met tools die zichzelf aansturen in GPT-5.6.
Google zet de release af tegen de eigen roadmap. Het bleef opvallend stil rond Gemini 3.5 Pro, dat werd uitgesteld, maar DeepMind zegt nu te zijn begonnen aan zijn “meest ambitieuze pre-trainingsronde tot nu toe” voor Gemini 4.
Wat betekent dit
Voor ontwikkelaars is 3.6 Flash vooral een rekensom die beter uitpakt: hetzelfde of beter resultaat voor minder geld per taak. De ingebouwde Computer Use maakt het aantrekkelijker om agents te bouwen die echt handelingen verrichten in plaats van alleen antwoorden geven. En met de pre-training van Gemini 4 al aan de gang, lijkt het tempo bij Google voorlopig hoog te blijven.
