Microsoft zet tokenbudget op AI-gebruik van engineers
3 mins read

Microsoft zet tokenbudget op AI-gebruik van engineers

Microsoft legt zijn eigen medewerkers aan banden bij het gebruik van AI-tools. In een interne mail die 404 Media deze week publiceerde, schrijft executive vice president Jay Parikh dat het bedrijf stopt met sturen op tokenverbruik. Zijn zin “tokenmaxxing is not what we are optimizing for” ging binnen een dag rond op Slashdot en werd opgepikt door The Register en TechRadar.

Divisies krijgen een tokenbudget

Volgens de mail hebben Microsoft-divisies sinds juli 2026 een AI token budget target. Medewerkers kunnen hun eigen verbruik terugzien in een dashboard. Een hard plafond noemt Parikh niet, wel de cijfers die de aanleiding vormen: veel engineers geven volgens hem honderden dollars per maand uit aan tokens, sommigen een paar duizend.

Parikh vraagt zijn mensen te focussen op “maximizing outcomes that move the needle for our customers and our business”. Het gaat hem om meer resultaat per token, schrijft hij, want zuinigheid op zichzelf is geen doel.

Twee collega's bespreken een budgetdocument in een vergaderruimte

GPT-5.6 wordt het standaardmodel

Om de rekening te drukken zet Microsoft intern GPT-5.6 van OpenAI als standaardmodel neer. Dat model is goedkoper in gebruik dan de zwaardere varianten die engineers via GitHub Copilot konden aanroepen. The Next Web wijst erop dat Microsoft in mei 2026 al de meeste Claude Code-licenties binnen de divisie Experiences and Devices schrapte, een besparing in dezelfde richting.

De keuze zegt iets over hoe bedrijven naar codeermodellen kijken. Prestatieverschillen tussen de topmodellen zijn klein geworden, zoals te zien was toen Claude Opus 5 de codeerkroon greep op LMArena. Bij dagelijks werk weegt de prijs per taak dan zwaarder dan de laatste procenten benchmarkscore.

Microsoft is niet de eerste

The Next Web zet Microsoft in een rijtje met Amazon, Adobe, Atlassian, Citi, Meta, Uber en Walmart, die eerder al limieten stelden aan het AI-verbruik van personeel. De prijs per token is sinds eind 2022 met ongeveer 98 procent gedaald, terwijl de facturen van bedrijven verdrievoudigden. De verklaring zit in agentische tools, die per opdracht veel meer tokens verstoken dan een gewone chatvraag. Dat patroon zagen we terug bij codeeragents die wetenschappelijke software versnelden, waar een enkele run uren rekenwerk kost.

Dat AI-budgetten krap worden, past bij het beeld dat we eerder beschreven toen bedrijven de rem zetten op hun AI-uitgaven. De experimenteerfase is voorbij, de inkoopafdeling kijkt mee.

Wat betekent dit

Voor Nederlandse organisaties die met Copilot of ChatGPT werken, is de les praktisch. Meet wat een AI-taak kost voordat je hem uitrolt over honderden gebruikers, en kies per taak een model in plaats van standaard het duurste. Een samenvatting van een verslag heeft geen redeneermodel nodig, een lastige refactor misschien wel.

Verder laat de mail zien dat de discussie verschuift van “mag AI dit” naar “wat mag AI dit kosten”. Waar de Rust-gemeenschap vorige week nog grenzen stelde aan LLM-code in de kernrepository, gaat het bij Microsoft puur om geld. Beide vragen komen in de praktijk op hetzelfde neer: waar levert dit model echt iets op, en waar is het gewoon duur speelgoed.