Google toont Gemini 4 Argon, maar eerst alleen voor beveiligers
Google heeft woensdag Gemini 4 Argon gepresenteerd, de opvolger van de Gemini 3-reeks en volgens het bedrijf zijn sterkste model tot nu toe. Gewoon gebruiken kan nog niet. Argon gaat eerst alleen naar een selecte groep beveiligers, terwijl de Amerikaanse overheid het model vooraf test.
Eerst naar cyberverdedigers
In een blogpost van Koray Kavukcuoglu, die Google DeepMind dagelijks leidt, schrijft Google dat Argon nu uitrolt via het Fairwind-programma. Dat is een gesloten kanaal voor vertrouwde cyberverdedigers. Daarna volgen betalende API-klanten en abonnees van Google AI Ultra, en pas later de rest. Een datum noemt Google niet; het houdt het op “zo snel mogelijk”.
Die aanpak is inmiddels de norm. Techzine wijst erop dat Fairwind het equivalent is van Project Glasswing bij Anthropic en Daybreak bij OpenAI. Ook OpenAI hield GPT-6 Cyber eerder achter slot, en Google deed hetzelfde al met Gemini Flash Cyber voor overheden. De reden: modellen die zelf lekken vinden, kunnen die lekken net zo goed misbruiken. Eind september bleek al dat GPT-6 Astra een kritieke cyberdrempel haalde.

Wat Argon kan volgens Google
Google claimt 77,9 procent op DeepSWE v1.1, een test met echte software-engineeringtaken. Op CWE-bench, dat meet hoe goed een model beveiligingsfouten repareert, deelt Argon met 68 procent de eerste plaats. Op AutomationBench scoort het 51,3 procent. Volgens Techzine zit Argon daarmee op het niveau van Claude Fable 5.1 en GPT-6 Astra. Het zijn wel cijfers van Google zelf; onafhankelijke metingen ontbreken nog.
Opvallender is de outputlimiet. Argon kan tot 1 miljoen tokens in één antwoord teruggeven, waar dat eerder 64.000 was. Dat maakt grote klussen mogelijk, zoals het herschrijven van een complete codebase. Google zegt Argon intern al te gebruiken om C- en C++-code naar Rust om te zetten, onder meer de Zircon-kernel van ruim 800.000 regels. In de datacenters van Google maakte het model bovendien meer dan 300 TiB geheugen vrij zonder extra hardware.
Beveiligingsbedrijf Wiz test Argon in zijn Scan for Good-initiatief en vond daarmee volgens The Next Web een kritiek lek in zorgsoftware dat eerdere modellen hadden gemist. Dezelfde site meldt dat sommige Google-medewerkers twijfelen of de benchmarkscores in de praktijk standhouden.
Prijs en veiligheid
Tijdens de introductie kost Argon 2 dollar per miljoen inputtokens en 10 dollar per miljoen outputtokens. Daarna wordt dat 4 en 20 dollar. Gecachte input krijgt 95 procent korting. Ter vergelijking: OpenAI zette deze week GPT-6.1 Sol neer als goedkoper alternatief voor Astra.
Voor veiligheid noemt Google onder meer monitoring van interne activaties om misbruik te herkennen, training tegen prompt-injectie en het afsluiten van taken als de redenering van het model afwijkt. Het vrijwillige vooronderzoek door de Amerikaanse overheid sluit aan bij het akkoord dat techbedrijven dinsdag met het Witte Huis tekenden.
“Een model dat zelf lekken vindt en dicht, is pas waardevol als je eigen mensen het ook begrijpen. Organisaties die nu investeren in kennis van hun eigen AI-tools, zijn straks niet afhankelijk van één leverancier.”
Leon Tindemans, AI-expert en Copilot- & ChatGPT-trainer. Hij verzorgt de ChatGPT-training van TTM Communicatie
Wat betekent dit
Met Argon heeft Google weer een model dat meedoet in de top, na maanden waarin OpenAI en Anthropic het tempo bepaalden. Voor Nederlandse bedrijven en ontwikkelaars verandert er voorlopig weinig: wie geen deel uitmaakt van Fairwind, moet wachten. Wel tekent zich een patroon af. De sterkste modellen gaan eerst naar verdedigers en overheden, en pas daarna naar iedereen. Wie wil weten waar Argon vandaan komt, vindt meer over de voorganger op onze pagina over Gemini 3.5 Pro. De echte test komt zodra onafhankelijke onderzoekers en klanten het model in handen krijgen.
