Sakana zet router Fugu Max in tegen frontier-prijzen
3 mins read

Sakana zet router Fugu Max in tegen frontier-prijzen

Het Japanse Sakana AI heeft twee nieuwe versies van zijn Fugu-systeem uitgebracht: Fugu Max en Fugu Ultra v2. Geen klassieke taalmodellen, maar orkestrators. Fugu is getraind om binnenkomend werk te verdelen over een vaste verzameling open-weight en gespecialiseerde modellen, en kan daarbij kopieën van zichzelf aanroepen. Sakana publiceerde de aankondiging op 11 september op zijn eigen site.

De prijs valt het meest op. Fugu Max kost 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens. Dat ligt volgens Sakana 40 tot 60 procent onder de uitvoerprijs van frontier-modellen als Sonnet 5, GPT-5.6 Terra en Kimi K3. Fugu Ultra v2 mikt op het andere uiteinde en rekent 5 dollar in en 30 dollar uit, met cache reads op 0,50 dollar per miljoen tokens.

Routeren in plaats van één groot model

De gedachte achter Fugu is dat niet elke deeltaak het duurste model nodig heeft. Een samenvatting, een zoekactie en een lastige refactor komen bij verschillende modellen terecht, aangestuurd door een model dat leert welk werk waar hoort. Fugu Max breidt de poel uit met een groter aantal open-weight modellen, waaronder de Nemotron-familie van NVIDIA via een samenwerking met dat bedrijf. Fable 5, Fable 5.1 en GPT-6 Astra zitten er niet in.

Handen van een ontwikkelaar op een mechanisch toetsenbord in een kantoortuin met monitoren op de achtergrond

Sakana claimt dat Fugu Max op zes benchmarks de beste totaalscore haalt, waaronder Terminal Bench 2.1, GPQAD, AutomationBench en SWEFish, en dat het op zeven van de tien geteste benchmarks de kosten-prestatiegrens opschuift. Bij Ultra v2 gaat het om vijf benchmarks met de hoogste of gedeeld hoogste score, met Chartography als uitschieter: 48,3 tegen 27,3 voor Opus 5. Op DeepSWE noteert Sakana 74,3. Dit zijn cijfers van de aanbieder zelf, onafhankelijke herhaling ontbreekt nog.

Waarom dit nu gebeurt

Routers winnen terrein omdat het prijsverschil tussen open en gesloten modellen groot blijft. We schreven eerder over de prijzenoorlog rond DeepSeek V4 Flash en over Chinese modellen die terrein winnen bij Amerikaanse bedrijven. Wie honderden agentstappen per opdracht draait, merkt dat verschil direct op de factuur. Bij open code-agents zoals OpenHands 1.0 speelt dezelfde afweging.

Tegelijk verplaatst de concurrentie zich van het model naar de laag eromheen. OpenAI zette die stap deze week zelf met de Agents API in publieke bèta, waarmee het eigen Codex-harnas achter één API-aanroep beschikbaar komt. Sakana kiest de omgekeerde route: niet één huismodel achter een harnas, maar een router die per stap kiest uit andermans modellen.

Wat betekent dit

Voor ontwikkelaars is de drempel laag. Beide varianten draaien via een OpenAI-compatibele API en bestaande Fugu-gebruikers stappen over met één gewijzigde parameter. Interessanter is de vraag wie straks de marge pakt. Als een router structureel dezelfde kwaliteit levert tegen de helft van de prijs, wordt het frontier-model een inwisselbaar onderdeel in plaats van het product waar je een contract mee tekent. Dat raakt precies de labs die het hardst blijven uitbrengen, iets wat we eerder zagen bij het hoge releasetempo van de grote AI-labs. Voorlopig staan de claims van Sakana nog op eigen benchmarks. De echte test volgt bij de eerste bedrijven die hun agentkosten naast elkaar leggen.