Gemini 3.8 Flash richt zich op programmeerwerk
Google heeft Gemini 3.8 Flash uitgebracht, een model dat intern de codenaam Skimaki droeg en dat vooral op programmeerwerk mikt. De release komt drie weken na de vorige Flash-versie. Volgens Artificial Analysis is dit al de vierde Flash-variant in nog geen vier maanden, een tempo dat Google eerder deze zomer ook al aanhield.
Hoger op de index, duurder per taak
Artificial Analysis zet het model op 59 punten in zijn Intelligence Index bij de hoogste reasoning-stand, tegen 56 voor Gemini 3.7 Flash. Op medium is dat 57, op laag 52. Daarmee komt Flash op hetzelfde niveau uit als GPT-5.6 Sol op zijn zwaarste instelling en Grok 4.6 op medium, allebei modellen uit een duurdere klasse.
Die winst kost wel iets. Het model produceert gemiddeld 48.000 outputtokens per taak, dertig procent meer dan zijn voorganger, en de kosten per taak lopen op van 0,40 naar 0,58 dollar. Google beschrijft dat zelf als harder werken: 3.8 Flash zet extra redeneerstappen en roept gereedschappen vaker achter elkaar aan.

Introductieprijs tot eind december
Ontwikkelaars betalen 0,75 dollar per miljoen inputtokens en 3,75 dollar per miljoen outputtokens. Die tarieven gelden tot 31 december, daarna gaat de prijs naar 1,50 en 7,50 dollar. Gecachete input krijgt negentig procent korting. Het contextvenster blijft een miljoen tokens en de uitvoersnelheid ligt rond de 300 tokens per seconde. Twee weken geleden halveerde Google nog de prijs van 3.7 Flash, dus de introductietarieven sluiten aan bij wat gebruikers gewend zijn geraakt.
Coderen als inhaalslag
Google richt zich met deze versie op software-engineering en agentische taken. Op DeepSWE v1.1 laat het model volgens Google grotere frontier-modellen achter zich bij het zelfstandig oplossen van complexe engineeringproblemen, tegen een fractie van de kosten. Op de tool-gebruiktest tau-3 Banking haalt het 45 procent, twaalf punten hoger dan 3.7 Flash. Coderen is precies het terrein waar Google achterliep op Anthropic en OpenAI, en waar Alibaba deze week ook een claim legde met Qwen3.8-Max in Code Arena.
Het model staat live in de Gemini-app voor abonnees van Google AI Pro en Ultra, in AI Mode en in Gemini in Google Sheets. Ontwikkelaars kunnen erbij via Google Antigravity, AI Studio en de Gemini API, meldt 9to5Google.
Wat betekent dit
Wie Flash inzet voor codewerk krijgt een slimmer model, maar moet niet op een lagere rekening rekenen. De kosten per taak stijgen met veertig procent, simpelweg omdat het model meer tokens verstookt. Tot eind december dempt de introductieprijs dat effect. Voor teams die nu een model kiezen wordt het tokenverbruik daarmee net zo belangrijk als de plek op een benchmarklijst. En met vier Flash-versies in vier maanden is de kans reeel dat er in oktober alweer een opvolger klaarstaat.
