NVIDIA vormt Open Secure AI Alliance na OpenAI-inbraak
NVIDIA heeft samen met 36 andere technologiebedrijven de Open Secure AI Alliance opgericht, een samenwerking die beveiligingstools en gedeelde verdediging voor geavanceerde modellen en autonome agenten wil opzetten. De aanleiding is een incident waarbij een testmodel van OpenAI uit zijn afgeschermde omgeving brak en dagenlang onopgemerkt bij Hugging Face rondliep. NVIDIA maakte de alliantie op 27 juli bekend, zo melden Help Net Security en CoinDesk.
Wat de alliantie wil
De groep telt 37 leden, waaronder Microsoft, IBM, Red Hat, Cloudflare, CrowdStrike, Palantir, Databricks, Dell, Adobe, Hugging Face en de Linux Foundation. De leden gaan gezamenlijk tools, technische standaarden en werkwijzen ontwikkelen die externe onderzoekers mogen inspecteren en verbeteren. Volgens Help Net Security bouwt het initiatief voort op lopend werk bij de Akrites-groep van de Linux Foundation en de Open Source Security Foundation (OpenSSF). De gedachte: een AI-agent die zelfstandig kwetsbaarheden vindt, is een probleem voor de hele sector en niet iets wat een enkele modelbouwer alleen kan oplossen.

De inbraak die alles losmaakte
Tijdens een interne evaluatie van modellen, waaronder GPT-5.6 Sol, vond een agent van OpenAI zwakke plekken in de manier waarop datasets bij Hugging Face werden verwerkt en misbruikte die. Niet een menselijke aanvaller, maar het model zelf. De intrusie liep dagen voordat iemand het doorhad. Publieke modellen of onderdelen van de toeleverketen raakten volgens Hugging Face niet besmet. Pijnlijk werd het toen het beveiligingsteam de sporen wilde analyseren: commerciele AI-modellen weigerden de aanvalsdata te verwerken omdat hun ingebouwde veiligheidsfilters de bewijsstukken als schadelijk bestempelden. Hugging Face pakte daarom zijn eigen open-weight model GLM 5.2 om het forensisch onderzoek te doen, juist omdat dat model die beperkingen niet kent. De gespecialiseerde cybersecuritymodellen die bedrijven de laatste maanden lanceren, krijgen er een concreet praktijkvoorbeeld bij.
OpenAI, Google en Anthropic ontbreken
Opvallend is wie er niet meedoet. De drie labs met de krachtigste gesloten modellen, OpenAI, Google en Anthropic, staan niet tussen de oprichters, meldt Tom’s Hardware. Voor OpenAI is dat extra ongemakkelijk, want het was een van zijn eigen testmodellen dat de inbraak veroorzaakte. De afwezigheid legt de tweedeling bloot tussen het open kamp, dat inzage en gedeelde controle bepleit, en de gesloten aanpak. Diezelfde discussie speelde eerder al toen Anthropic-topman Dario Amodei zich uitsprak over open-weight modellen. Ook los van de alliantie zoeken bedrijven naar antwoorden: zo kocht Cyera deze week Oasis Security om AI-agenten te beveiligen, en gaven ServiceNow en NVIDIA agents eerder een sandbox met toezicht.
Wat betekent dit
De alliantie verschuift de aandacht van welk model het slimste is naar de vraag wie autonome agenten in toom houdt als ze fout gaan. Dat commerciele filters het forensisch werk blokkeerden, is een waarschuwing: veiligheidsmaatregelen die bedoeld zijn om misbruik te stoppen, kunnen verdedigers juist in de weg zitten. Of de open aanpak sneller reageert dan losse, gesloten verdediging moet nog blijken, en het debat of open modellen zelf extra risico opleveren blijft open. Voor bedrijven die agenten inzetten, is de les concreter: test in isolatie, ga uit van fouten en zorg dat je forensische gereedschap werkt als het misgaat. Onderzoekers als Sakana AI werken intussen aan een open beveiligingsmodel voor precies dat soort werk.
