Okta wil tokenrekening van AI-agents met 90 procent omlaag
Bedrijven die AI-agents inzetten betalen voor iets wat ze zelden gebruiken: de complete gereedschapskist die bij elke beurt in de prompt wordt geladen. Okta noemt dat de tool tax en zegt die met identiteitsregels flink te kunnen drukken. Volgens de eigen modellering, gepubliceerd op 13 augustus en beschreven door AI News, verdwijnt in sommige scenario’s meer dan 90 procent van de zichtbare tools uit de prompt.
Wat de tool tax precies is
Een agent die via het Model Context Protocol met externe systemen praat, krijgt bij elke beurt de schema’s van alle beschikbare tools voorgeschoteld: namen, beschrijvingen en parameters. Die tekst kost tokens, ook als de agent er geen enkele van aanroept. Bij een MCP-server met tientallen tools loopt dat op, want de kosten komen terug in elke ronde van het gesprek. Okta koppelde de tools van een MCP-server aan OAuth-scopes en rekende door wat gebruikersgroepen als helpdeskmedewerkers, beheerders en superbeheerders daadwerkelijk mogen. De helpdesk heeft nu eenmaal een kortere lijst nodig dan een superbeheerder.

Filteren op twee momenten
De aanpak grijpt op twee plekken in. Bij het samenstellen van de prompt wordt de toollijst gefilterd op basis van de identiteit van de agent en de gebruiker erachter. Vlak voor uitvoering controleert het systeem de scope opnieuw, zodat een agent niets kan aanroepen wat buiten zijn rechten valt. De kosten van de toolschema’s dalen volgens Okta ongeveer evenredig met het aantal weggefilterde tools. Absolute bedragen of tokenaantallen geeft het bedrijf niet, en de berekening steunt op eigen productdata en openbare documentatie van leveranciers, niet op klantgegevens. Paul Webber, cybersecurity-analist bij Software Analyst Cyber Research, koppelt kostenbeheersing bij agents expliciet aan identity governance.
Beveiliging die toevallig ook geld scheelt
Het aardige aan deze ingreep is dat hij vanuit twee hoeken te verdedigen valt. Minder zichtbare tools betekent een kleiner aanvalsoppervlak voor prompt injection, en tegelijk een kleinere rekening. Dat sluit aan bij de richting die de sector opgaat met de nieuwe MCP-spec in Claude en met Agent Plugins als gedeelde standaard. Ook aan de kostenkant is Okta niet alleen: Writer beloofde eerder een halvering van de kosten van AI-agents, en toezichthouders werken via het SAFE-raamwerk voor incidentmeldingen aan de verantwoordingskant.
Wat betekent dit
Wie agents in productie heeft, kan hier vrij snel naar kijken. Tel eens hoeveel tools er in de systeemprompt staan en hoeveel daarvan een gemiddelde gebruiker mag aanroepen. Zit daar een groot gat tussen, dan betaalt u elke beurt voor lucht. De cijfers van Okta komen uit een model en niet uit een onafhankelijke meting, dus neem de 90 procent als bovengrens en meet zelf na. De onderliggende gedachte houdt hoe dan ook stand: toegangsrechten die u toch al moet inrichten, kunt u net zo goed laten meebepalen wat het model te zien krijgt. Voor organisaties die hun agents laten rondkijken op het web geldt dat des te sterker, want daar groeit de gereedschapskist het snelst.
