SAFE-regels dwingen bedrijven incidenten met AI-agents te melden
Een coalitie van meer dan 120 techbedrijven wil dat incidenten met AI-agents voortaan gemeld worden volgens vaste termijnen. De Open Secure AI Alliance publiceerde tijdens Black Hat in Las Vegas een concept voor de Shared AI Findings Exchange, kortweg SAFE. NVIDIA, Cisco, CrowdStrike, Hugging Face en Red Hat schreven mee, de Linux Foundation beheert het proces en heeft een Request for Comments geopend.
Vier werkdagen om een incident te melden
Het concept legt drie klokken vast, meldt Cybersecurity Dive. Wie een geloofwaardig datalek constateert, waarschuwt getroffen klanten binnen 72 uur. Binnen vier werkdagen gaat er een vertrouwelijk rapport naar de uitwisseling zelf. Binnen dertig dagen volgt een voorlopig openbaar verslag, tenzij juridisch of veiligheidsonderzoek dat blokkeert.
Wat er gemeld moet worden is redelijk scherp omschreven: ongeautoriseerde toegang tot systemen van derden door een AI-systeem, het lekken van vertrouwelijke gegevens, en agents die productieomgevingen blijven aftasten nadat de operator al vermoedt dat het misgaat. Ook bijna-incidenten vallen eronder. Deelnemers moeten bewijs bewaren: prompts, agent traces, tool calls, identiteiten, rechten en gebruikte inloggegevens.

Geleend van de luchtvaart
Justin Boitano, vice president enterprise computing bij NVIDIA, vertelde Axios dat het programma is gemodelleerd naar het veiligheidsmeldsysteem van NASA voor de luchtvaart. Daar wordt na een voorval de vluchtrecorder uitgelezen, en de conclusies gaan naar de hele sector in plaats van naar één maatschappij. De redenering achter SAFE is dezelfde. Bedrijven onderzoeken incidenten met AI nu vooral intern, waardoor de kennis blijft hangen waar hij ontstond.
De aanleiding is concreet genoeg. Eerder deze maand bleek dat AI-agenten uit hun eigen veiligheidstests ontsnapten en systemen van derden raakten. Hugging Face werd aangevallen. Deze week nog kwam de LiteLLM-inbraak naar buiten, waarbij via één pakket zo’n 2.500 bedrijven werden geraakt. De alliantie zelf ontstond eind juli, na de inbraak bij OpenAI.
OpenAI en Anthropic doen niet mee
Opvallend is wie ontbreekt. OpenAI en Anthropic zijn geen lid van de alliantie, terwijl hun modellen achter een groot deel van de agents in bedrijven draaien. Amazon, Microsoft, Visa en Okta staan er wel bij. Microsoft bracht daarnaast zijn testgereedschap PyRIT en RAMPART onder in de open bronbibliotheek van de alliantie, NVIDIA leverde de NOOA-onderzoeksharnas, de OpenShell-runtime en scanner Garak, Red Hat droeg Asago bij.
Deelname is vrijwillig. Zonder toezichthouder die meekijkt, hangt de waarde van zo’n uitwisseling af van hoeveel bedrijven bereid zijn hun eigen blunders op te schrijven.
Wat betekent dit
Voor Nederlandse organisaties die agents inzetten is dit vooral een lijst met huiswerk. Het aantal AI-agenten binnen bedrijven verdrievoudigde in een jaar, en de meeste incidentprocedures gaan nog uit van menselijke gebruikers en klassieke malware. Prompts, tool calls en agent-identiteiten worden zelden zo gelogd dat je achteraf kunt reconstrueren wat er gebeurde.
Wie nu al bewaart wat SAFE wil zien, kan straks aansluiten zonder verbouwing. Wie dat niet doet, staat bij het volgende incident met lege handen tegenover de eigen securityafdeling en de klant die om uitleg vraagt. De commentaarronde bij de Linux Foundation loopt nog, dus de definitieve termijnen kunnen schuiven.
