AI Safety Index 2026: Anthropic bovenaan met een C+
Het Future of Life Institute (FLI) heeft zijn AI Safety Index voor de zomer van 2026 gepubliceerd, en het beeld is weinig geruststellend. Geen enkel groot AI-lab haalt een voldoende die in de buurt van een A komt. Anthropic staat bovenaan, maar blijft steken op een C+. De rest van de sector zakt daaronder weg, met drie labs op een regelrechte onvoldoende.
Anthropic voorop, xAI en DeepSeek onderaan
Volgens het rapport, dat door TIME werd besproken, voert Anthropic de ranglijst aan met een C+. OpenAI en Google DeepMind volgen met een C, Meta krijgt een D+. De Chinese labs Z.ai en Alibaba Cloud blijven op een D-. Onderaan bungelen xAI, DeepSeek en het Franse Mistral, alle drie met een F. Anthropic leidt in vijf van de zes beoordeelde domeinen, vooral dankzij zijn transparantie en een relatief uitgewerkt veiligheidskader. OpenAI staat wel bovenaan bij risicobeoordeling, door een bredere testsuite en meer samenwerking met externe partijen.

Terugtrekkende beloftes
De grootste zorg van de onderzoekers zit niet in de rapportcijfers zelf, maar in een patroon dat eronder ligt. Anthropic, OpenAI, Google DeepMind en Meta hadden eerder beleid vastgelegd waarin ze beloofden de ontwikkeling stil te leggen of releases te beperken zodra hun modellen bepaalde risicogrenzen zouden naderen. Die toezeggingen zijn de afgelopen maanden intern afgezwakt of losgelaten, aldus het FLI. De onafhankelijke jury die de index samenstelt noemt dat een verontrustende ontwikkeling: juist nu de modellen krachtiger worden, verdwijnen de zelfopgelegde remmen. Seoul Economic Daily tekende bij experts eenzelfde waarschuwing op.
Waarom een externe index?
De AI Safety Index laat een panel van onafhankelijke deskundigen negen labs beoordelen op zes gebieden, waaronder risicobeoordeling, governance en transparantie. Het is geen wettelijke toets, maar een poging om vergelijkbaar te maken wat bedrijven zelf zelden op tafel leggen. Dat sluit aan bij de richting die toezichthouders inslaan. In Europa gaan vanaf 2 augustus de eerste boetebepalingen van de EU AI Act in, en aan de bredere uitwerking daarvan wordt nog gesleuteld in het omnibus-traject. In de Verenigde Staten koos Illinois als eerste staat voor verplichte veiligheidsaudits. De index vult die publieke druk aan met een cijfer dat iedereen kan lezen.
Wat betekent dit
Een C+ als hoogste score zegt vooral dat de sector zichzelf nog niet op orde heeft, ook niet de partij die er het verst in is. Voor gebruikers en bedrijven die op deze modellen bouwen is dat een reden om claims over veiligheid kritisch te blijven bekijken, en te kijken naar wat labs daadwerkelijk publiceren in plaats van naar wat ze beloven. Anthropic laat met programma’s als Project Glasswing zien dat het veiligheidsonderzoek serieus neemt, maar het rapport maakt duidelijk dat transparantie en concrete grenzen twee verschillende dingen zijn. De volgende editie van de index zal moeten uitwijzen of de afgezwakte beloftes een uitschieter waren of het begin van een trend.
