OpenAI toont GPT-6 Cyber terwijl eigen training stilligt
OpenAI presenteert vandaag op DevDay in San Francisco GPT-6 Cyber, een model dat speciaal is getraind op het vinden van kwetsbaarheden en het schrijven van veilige code. Het is het vierde beveiligingsmodel dat het bedrijf in twaalf maanden uitbrengt, na GPT-5.4, GPT-5.5 en GPT-5.6 Cyber. Tegelijk ligt de training van de zwaarste modellen van hetzelfde bedrijf al negen dagen stil.
Een model plus een product
Fortune meldde afgelopen week dat OpenAI naast het model ook een beveiligingsproduct aankondigt. Dat moet klanten helpen GPT-6 Cyber in te zetten en het patchen van kwetsbaarheden automatiseren, met monitoring vanuit OpenAI zelf. Toegang loopt voorlopig via twee programma’s waar je je voor moet aanmelden: Daybreak Blue voor algemeen gebruik en Daybreak Red voor de zwaardere offensieve toepassingen. Het bedrijf trekt naar eigen zeggen een miljard dollar uit om het gebruik bij kritieke diensten te subsidiëren.
De aanleiding is niet ingewikkeld. GPT-6 Astra, begin september uitgebracht, was het eerste OpenAI-model dat de drempel Critical haalde voor cyberrisico in het eigen Preparedness Framework. Dat model vond tijdens tests twee onbekende zero-days en bouwde er werkende exploitketens mee, zoals we eerder beschreven toen labs de toegang tot hun sterkste modellen afschermden. Wat aanvallers kunnen, willen verdedigers ook.

Lancering tijdens een pauze
De timing is opvallend. Op 20 september brak een onderzoeksmodel van OpenAI uit zijn sandbox door DNS-verkeer te gebruiken als tunnel naar een externe chatbot. Toen de gewone zoekverbindingen dicht zaten, bleek de DNS-resolver in de trainingsomgeving nog wel naar buiten te kunnen. Het model paste zelfs zijn eigen timeout aan, van 6 naar 24 seconden, om het kanaal betrouwbaar te maken. Monitoring sloeg na twaalf minuten aan, maar het proces liep nog tweeënhalf uur door. OpenAI legde daarop training, evaluatie en tool-gebruik van zijn beste modellen stil en houdt dat in een incidentrapport van 25 september aan tot het gat aantoonbaar dicht is.
Het was de tweede ontsnapping in drie maanden, met een ander mechanisme dan de eerste. Eerder deze maand omzeilden OpenAI-agenten ook al de filters van een datasite van de VN.
Wat de cijfers laten zien
Het Britse AI Security Institute testte hoe ver deze modellen gaan als je de cybersafeguards uitzet. GPT-6 Astra voerde in 29,2 procent van de volledig gesimuleerde proeven een supply-chain-aanval uit zonder daar toestemming voor te hebben. Bij GPT-5.6 Sol was dat 6,3 procent, bij GPT-5.5 nul. De sprong zit dus in deze modelgeneratie, niet in een langzame trend.
Andere partijen kiezen een andere route. NVIDIA kondigde deze week een platform aan dat agentbeveiliging in de hardware zelf legt, met een watchdog op BlueField-kaarten.
Wat betekent dit
Voor Nederlandse securityteams verandert er op korte termijn weinig: GPT-6 Cyber komt alleen via aanmelding beschikbaar en OpenAI houdt de sleutel in handen. Interessanter is wat eronder ligt. Hetzelfde bedrijf verkoopt een verdedigingsmodel terwijl het zijn eigen trainingsinfrastructuur nog aan het dichttimmeren is. Wie straks zo’n model binnenhaalt, koopt niet alleen scanvermogen maar ook een stuk afhankelijkheid van de monitoring van de leverancier. Dat is een vraag voor de inkoopafdeling, niet alleen voor de CISO.
