Grok 4.5 verbruikt minder tokens dan Opus 4.8
xAI bracht Grok 4.5 op 8 juli uit, en de eerste onafhankelijke metingen laten iets opvallends zien. Het model staat niet bovenaan de ranglijsten, maar het verbruikt fors minder rekentokens per taak dan de concurrentie. Voor bedrijven die AI-agents op schaal draaien, verandert dat de rekensom. Dit komt kort na de openbare lancering van Grok 4.5.
Vierde plek, maar zuiniger
Op de Intelligence Index van Artificial Analysis scoort Grok 4.5 een 54, goed voor de vierde plaats. Alleen Claude Fable 5, GPT-5.5 en Claude Opus 4.8 staan hoger. De echte verrassing zit in het tokenverbruik. Volgens Artificial Analysis heeft Grok 4.5 ongeveer 14.000 outputtokens nodig per taak op die index, tegenover ruim 67.000 voor Opus 4.8. Op de codeerbenchmark SWE-Bench Pro rapporteert xAI zelf een gemiddelde van zo’n 16.000 tokens per taak, waar Opus 4.8 op maximale instellingen rond de 67.000 zit. Dat is een verschil van meer dan vier keer.
Minder tokens per taak betekent lagere kosten en snellere antwoorden. Die eigenschap valt op in een week waarin meerdere topmodellen tegelijk verschenen en de aandacht vooral naar ruwe benchmarkscores ging.
Wat de prijs betekent voor agents
Grok 4.5 kost 2 dollar per miljoen inputtokens en 6 dollar per miljoen outputtokens. Cache-hits krijgen 75 procent korting, tot 0,50 dollar per miljoen tokens. Daarmee ligt het model volgens Artificial Analysis meer dan 60 procent onder de prijs van Opus 4.8 en GPT-5.5. Omgerekend komt een taak op de Intelligence Index uit op ongeveer 0,31 dollar, en een taak op de Coding Agent Index binnen Grok Build op iets minder dan 2,60 dollar.
Die combinatie van een lage prijs en weinig tokenverbruik telt op bij agentische workloads, waar een systeem soms honderden stappen achter elkaar zet. Ook andere aanbieders schuiven die kant op. Anthropic bracht kort geleden Claude Sonnet 5 als goedkoper agent-model uit, en OpenAI zette met ChatGPT Work in op geautomatiseerde taken.
Een kleiner contextvenster
Niet alles gaat vooruit. Het contextvenster van Grok 4.5 zakt naar 500.000 tokens, waar Grok 4.3 nog een miljoen tokens aankon. Het model telt volgens xAI 1,5 biljoen parameters, drie keer zo veel als de voorganger. Wie zeer lange documenten in één keer wil verwerken, houdt dus rekening met de gehalveerde ruimte. Voor de meeste code- en gesprekstaken blijft 500.000 tokens ruim voldoende.
Wat betekent dit
De frontier verschuift van pure intelligentie naar kosten per taak. Een model dat vierde staat maar veel goedkoper draait, kan voor veel toepassingen aantrekkelijker zijn dan de nummer één. Voor Nederlandse bedrijven die AI-agents willen inzetten, is het tokenverbruik voortaan net zo belangrijk om naar te kijken als de benchmarkscore. De prijzenslag die eerder zichtbaar werd bij Claude Fable 5 krijgt met Grok 4.5 een vervolg, en dat is goed nieuws voor iedereen die op schaal met deze modellen wil werken.
