Gemini 3.5 Flash: Google zet in op snelheid
Google heeft Gemini 3.5 Flash uitgebracht, een lichter model dat de nadruk legt op snelheid en een grote context. Volgens Google draait het model zijn uitvoer tot vier keer sneller dan andere frontier-modellen, terwijl het op een deel van de code- en agent-benchmarks beter presteert dan het zwaardere Gemini 3.1 Pro. Het model is direct beschikbaar in de Gemini-app, de API, Google Workspace en verschillende Google-diensten.
Wat Gemini 3.5 Flash anders maakt
De belangrijkste cijfers gaan over snelheid en geheugen. Gemini 3.5 Flash werkt met een contextvenster van 1 miljoen tokens, genoeg voor lange documenten of hele codebases in één keer. Google mikt met deze Flash-lijn op taken waarbij reactietijd telt: het snel doorlezen van meerdere bestanden, prototypes bouwen en agent-workflows die veel kleine stappen achter elkaar zetten. Dat het model op sommige coding-tests voorbij Gemini 3.1 Pro komt, is opvallend, want Flash-modellen zijn normaal de goedkopere en simpelere variant.
De positionering sluit aan op eerdere zetten van Google. Eerder dit jaar werkte het bedrijf al aan een zware variant, zoals te lezen in ons stuk over Gemini 3.5 Pro die richting release ging met 2 miljoen tokens. Google bevestigt dat 3.5 Pro in een latere fase volgt; Flash is nu eerst breed uitgerold.
Snelheid als verkoopargument
De timing is niet toevallig. Klanten kijken volgens berichtgeving van CNBC steeds kritischer naar de kosten per token en schakelen van dure, zware modellen naar snellere en zuinigere varianten. Een Flash-model dat op benchmarks in de buurt van een Pro-model komt, past precies bij die verschuiving. Google zet dat argument ook in tegen de concurrentie. OpenAI bracht net zijn GeneBench-Pro-tests naar buiten en Anthropic maakte Claude Sonnet 5 het standaardmodel. Ook goedkopere open modellen roeren zich, zoals GLM-5.2 dat GPT-5.5 uitdaagt op code en prijs.
Ter vergelijking: het grotere Gemini 3 Pro, dat Google in november 2025 lanceerde, scoorde 1501 Elo op de LMArena-ranglijst en 91,9 procent op GPQA Diamond. Die nummers gelden voor het topmodel, niet voor Flash. Google publiceerde voor 3.5 Flash zelf geen volledige benchmarktabel, maar wijst vooral op de snelheidswinst en de prijs. Wie precieze scores per test wil, moet die dus nog afwachten.
Breed uitgerold, niet alleen voor ontwikkelaars
Anders dan een pure ontwikkelaarsrelease landt Gemini 3.5 Flash meteen in producten die gewone gebruikers al kennen. Via Workspace komt het in Gmail, Docs en andere kantoortools, en in de Gemini-app wordt het het snelle standaardmodel. Google zette eerder al kleinere, snelle modellen in de markt, zoals te zien bij Nano Banana 2 Lite en Gemini Omni Flash. De lijn is duidelijk: veel losse modellen voor verschillende snelheids- en prijspunten, in plaats van één model dat alles moet doen.
Wat betekent dit
Voor bedrijven die AI in bulk gebruiken, is een snel en goedkoop model dat toch dicht bij Pro-niveau komt praktisch nieuws. Het verlaagt de drempel om AI in dagelijkse workflows te zetten, van klantcontact tot code-review. Tegelijk blijft voorzichtigheid gepast: Google leunt in de communicatie sterk op snelheid en op vergelijkingen met het eigen Pro-model, zonder een complete benchmarktabel. Wie 3.5 Flash serieus wil inzetten, doet er goed aan het te testen op de eigen taken voordat de zwaardere modellen definitief opzij gaan.
