Witte Huis toont AI-labs het definitieve toetsingskader
Het Witte Huis heeft deze week de belangrijkste AI-bedrijven van het land om de tafel gehaald om een afgerond raamwerk voor het beoordelen van geavanceerde AI-modellen te bespreken. Volgens CNBC en CNN waren vertegenwoordigers van OpenAI, Anthropic en Google dinsdag aanwezig. Het gaat om het sluitstuk van een traject dat begon met een presidentieel besluit op 2 juni, en het legt vast hoe de overheid straks meekijkt voordat een nieuw topmodel op de markt komt.
Wat er in Washington op tafel ligt
De kern is een toetsvenster van maximaal dertig dagen. Ontwikkelaars kunnen de overheid vroegtijdig toegang geven tot een zogeheten covered frontier model, waarna agentschappen die periode krijgen om de cyberrisico’s en misbruikmogelijkheden te onderzoeken. Alleen modellen boven een bepaalde, geheime capaciteitsdrempel vallen eronder. De benchmarks waarmee wordt gemeten zijn geclassificeerd, meldt CNBC, dus welke precieze grens een model over de streep trekt, blijft buiten beeld voor het publiek.
Dat sluit aan op een lijn die we eerder zagen ontstaan: overheden willen een vinger aan de pols voordat krachtige modellen breed beschikbaar worden. Het raamwerk zelf haalde begin deze maand de streefdatum van 1 augustus, en de bijeenkomst van dinsdag is de eerste keer dat de labs de complete tekst onder ogen kregen.

Dertig dagen, en vooral vrijwillig
Belangrijk detail: deelname is vrijwillig. Er is geen wettelijke plicht om een model in te dienen, en het raamwerk mag geen vergunningstelsel of verplichte voortoetsing worden. Naleving berust op afspraken, niet op een wet. De bedrijven hebben bovendien invloed gehad op de inhoud. Het Witte Huis stuurde de conceptversie een paar weken geleden naar Anthropic, OpenAI en Google, die er wijzigingen in aanbrachten.
Die betrokkenheid is niet vrijblijvend. Anthropic zet dit jaar zwaar in op aanwezigheid in Washington, en juist een vrijwillig kader geeft de labs ruimte om de spelregels mee te vormen. De vraag is hoe streng een toets kan zijn als een bedrijf op elk moment kan besluiten niet mee te doen.
Wie beoordeelt, en wie ontbreekt
De beoordeling komt volgens bronnen bij CNBC te liggen bij het Center for AI Standards and Innovation van het ministerie van Handel en bij de NSA. Die combinatie van een standaardeninstituut en een inlichtingendienst laat zien waar de zorg zit: niet zozeer bij consumentenschade, maar bij de vraag of een model bijvoorbeeld kan helpen bij cyberaanvallen. Dat risico is geen theorie meer, zoals bleek toen Claude-modellen in tests zelfstandig bij organisaties inbraken.
Opvallend is wie er niet aanschuift. Meta maakt geen deel uit van de afspraak, zo melden meerdere Amerikaanse media. Een vrijwillig kader zonder een van de grootste modelbouwers laat meteen de zwakke plek zien: het geldt alleen voor wie meedoet.
Wat betekent dit
Voor de VS is dit de eerste keer dat de overheid en de grote AI-labs een gedeeld proces afspreken voor het beoordelen van topmodellen, zonder dat er een wet aan te pas komt. Voor gebruikers en bedrijven in Europa verandert er op de korte termijn weinig, maar de richting is veelzeggend. Waar de EU met de AI-verordening op harde regels stuurt, kiest Washington voor afspraken die de sector zelf mee mag schrijven. Of dertig dagen genoeg zijn om een geheim getoetst risico echt af te vangen, zal pas blijken zodra het eerste model daadwerkelijk door de procedure gaat.
