Fireworks AI haalt 1,5 miljard op voor goedkope inferentie
2 mins read

Fireworks AI haalt 1,5 miljard op voor goedkope inferentie

Het AI-infrastructuurbedrijf Fireworks AI heeft een Serie D-ronde van 1,505 miljard dollar opgehaald, waarmee de waardering op 17,5 miljard dollar komt. CNBC en SiliconANGLE meldden op 16 juli dat vooral de vraag naar goedkopere manieren om AI-modellen te draaien de ronde stuwde.

Waar Fireworks zijn geld verdient

Fireworks traint zelf geen grote frontier-modellen. Het bedrijf helpt klanten om open modellen te verfijnen op hun eigen data en die daarna snel en tegen lage kosten te laten draaien. Volgens Fireworks komt inmiddels 95 procent van de tokens die het platform verwerkt uit zulke gespecialiseerde modellen. Bekende gebruikers zijn Uber, Shopify, GitLab en MongoDB, en ook de juridische AI-tool Harvey en codeerhulp Cursor bouwen erop, aldus SiliconANGLE.

Software-engineer aan een werkplek met meerdere schermen in een tech-kantoor

Wie er meebetaalt

De ronde werd geleid door Atreides Management, Index Ventures en TCV. Bestaande investeerders Lightspeed Venture Partners en chipmaker NVIDIA deden opnieuw mee. Dat NVIDIA weer instapt past bij een patroon waarin de chipfabrikant belangen neemt in bedrijven die veel van zijn hardware afnemen. Fireworks passeerde volgens Quartz een omzet op jaarbasis van meer dan 1 miljard dollar, vijf keer zoveel als ten tijde van de vorige ronde. Het aantal verwerkte tokens per dag groeide van 15 biljoen naar ruim 40 biljoen, een teken dat klanten productie draaien en niet alleen experimenteren.

Goedkoper draaien wint terrein

De ronde laat zien waar het geld in de sector naartoe schuift. Het gaat naar de labs die de grootste modellen trainen, en net zo goed naar de laag eronder: het draaien van modellen, oftewel inferentie. Steeds meer bedrijven kiezen kleinere, aangepaste modellen boven dure gesloten systemen. Diezelfde beweging zagen we eerder in de prijzenoorlog om goedkope AI-agents en in de opmars van Chinese open modellen. Ook bouwen labs vaker hun eigen inferentiechips om de kosten te drukken. Met het nieuwe kapitaal wil Fireworks zijn rekencapaciteit uitbreiden en de samenwerking met Microsoft en NVIDIA verdiepen.

Wat betekent dit

De strijd om AI verschuift van de vraag wie het slimste model heeft naar de vraag wie het goedkoopst en snelst kan draaien. Voor organisaties die AI inzetten daalt daarmee de drempel: een verfijnd open model op een platform als Fireworks kan een groot gesloten model evenaren op de taak die telt, tegen een fractie van de kosten. Dat het durfkapitaal massaal naar AI stroomt, maakt duidelijk dat investeerders geloven in aanhoudende vraag. Voor NVIDIA, dat steeds meer concurrentie voelt van eigen chips van klanten, is elke groeiende inferentiespeler tegelijk afnemer en risico.