AI-veiligheidsindex: geen lab boven een C+
De Future of Life Institute bracht deze zomer een nieuwe editie uit van zijn AI Safety Index, en het rapport is niet mals. Van de negen grootste AI-ontwikkelaars haalt geen enkele een cijfer boven een C+. Zeven onafhankelijke experts beoordeelden de bedrijven op 37 punten, verdeeld over zes domeinen die lopen van risicobeoordeling tot transparantie.
Anthropic bovenaan, de rest zakt weg
Anthropic eindigt met een C+ (score 2,66) op de eerste plek en leidt in vijf van de zes domeinen. OpenAI en Google DeepMind volgen met een C, respectievelijk 2,28 en 2,01. Meta krijgt een D+, terwijl de Chinese labs Z.ai en Alibaba Cloud blijven steken op een D-. Onderaan bungelen xAI, DeepSeek en Mistral, alle drie met een onvoldoende. Volgens de Future of Life Institute scoorde voor de tweede keer op rij geen enkel bedrijf hoger dan een D op existentiële veiligheid, het domein dat draait om de vraag of een lab de controle over zijn eigen systemen kan houden.

Beloftes over de noodrem afgezwakt
De scherpste kritiek gaat over gebroken toezeggingen. Anthropic, OpenAI, Google DeepMind en Meta beloofden eerder hun ontwikkeling te pauzeren zodra een model bepaalde gevaargrenzen zou naderen. Alle vier hebben die belofte inmiddels afgezwakt of geschrapt, schrijft TechTimes. Sommige labs koppelen een pauze nu aan wat de concurrentie doet: pas stoppen als de rest ook stopt. De beoordelaars noemen dat het verplaatsen van de doelpalen, gedrag dat volgens hen de veiligheidskaders over de hele linie ondergraaft.
Dat speelt op een moment dat de druk van buitenaf juist oploopt. In Europa kan Brussel sinds deze maand boetes opleggen onder de EU AI Act, en in de Verenigde Staten legde het Witte Huis de labs een definitief toetsingskader voor. Tegelijk lobbyt Anthropic harder dan ooit in Washington om mee te schrijven aan de regels.
Wat betekent dit
Voor bedrijven die AI inkopen is de index een nuchtere waarschuwing. Een C+ als hoogste cijfer laat zien dat zelfs de koplopers hun eigen veiligheidshuiswerk niet af hebben. MIT Sloan Management Review wijst erop dat het verschil tussen de kopgroep en de achterblijvers vooral in transparantie en governance zit, niet in de techniek zelf. Wie modellen in gevoelige processen wil inzetten, kijkt dus beter verder dan de benchmarkscores en vraagt naar het veiligheidsbeleid erachter. De aandacht voor de beveiliging van AI-agents groeit al, maar dit rapport laat zien dat het fundament, de belofte om op tijd te stoppen, nog wankel is.
