Alibaba toont eigen AI-chip Zhenwu V900
3 mins read

Alibaba toont eigen AI-chip Zhenwu V900

Alibaba heeft dinsdag op de Apsara-conferentie in Hangzhou zijn nieuwe AI-versneller Zhenwu V900 gepresenteerd, samen met een plan om de datacentercapaciteit richting 2032 fors op te rekken. CEO Eddie Wu noemde de chip de krachtigste die in China wordt gemaakt. CNBC meldde dat het aandeel Alibaba na de aankondiging steeg.

Wat de Zhenwu V900 kan

De V900 komt van T-Head, de chipdivisie van Alibaba, en volgt de Zhenwu M890 op die in mei verscheen. Alibaba claimt drie keer de prestaties van dat vorige model. De kaart heeft 216 GB geheugen aan boord en 1.200 GB/s aan onderlinge bandbreedte tussen chips. Volgens het bedrijf kan een enkel cluster tot 500.000 kaarten aansturen, genoeg om modellen van tien biljoen parameters te trainen. Massaproductie staat gepland voor het eerste kwartaal van 2027.

Die getallen zijn claims van de fabrikant zelf. Onafhankelijke benchmarks van de V900 zijn er nog niet, en de vergelijking met NVIDIA-hardware maakte Alibaba niet expliciet. Wel past de stap in een patroon dat we eerder zagen bij DeepSeek, dat wil trainen op chips van Huawei: Chinese labs bouwen hun trainingsstack steeds vaker rond binnenlands silicium.

Lange rijen serverracks in een datacenterhal met een technicus in het gangpad

Qwen 4 en modellen van biljoenen parameters

Wu schetste ook een modelroutekaart. Qwen 4 wordt nu getraind, met varianten Max, Flash, Plus en een compacte 27B. Daarna volgen Qwen 4.5 en Qwen 5. Reuters meldde dat Alibaba mikt op een model tussen de vijf en tien biljoen parameters, ruim een orde van grootte boven wat het bedrijf nu in productie heeft.

Alibaba heeft de afgelopen maanden veel open uitgebracht, al zit daar een addertje onder het gras: bij Qwen-Image-2.1 bleek de licentie commercieel gebruik uit te sluiten. Ook het medische model voor CT-scans van onderzoeksinstituut DAMO kwam dit jaar naar buiten.

Twintig gigawatt aan datacenters

Het derde onderdeel is infrastructuur. Alibaba Cloud wil in 2032 wereldwijd meer dan 20 gigawatt aan datacentercapaciteit hebben draaien. Ter vergelijking: dat is een veelvoud van wat westerse aanbieders vandaag operationeel hebben, en het bedrag aan kapitaal dat daarvoor nodig is, ligt in dezelfde categorie als de miljardenrondes die Amerikaanse bouwers als Crusoe ophalen.

De timing is opvallend. In Washington wordt gewerkt aan strengere exportcontroles op chiptechnologie richting China. Hoe strakker die regels worden, hoe meer waarde een eigen versneller krijgt, ook als die per kaart langzamer is dan de Amerikaanse topmodellen. Je kunt er tenminste op rekenen.

Wat betekent dit

Voor Nederlandse organisaties verandert er op korte termijn weinig. De V900 gaat pas in 2027 in productie en komt vrijwel zeker niet los te koop buiten China. Indirect telt het wel: als Alibaba Cloud goedkoop kan blijven trainen op eigen hardware, drukt dat de prijs van Qwen-modellen, en die zijn via de gewone API en via Europese hosters gewoon bruikbaar. Prijsdruk van die kant is de afgelopen twee jaar de belangrijkste reden geweest dat tokens goedkoper werden.

Wat je nu kunt doen: houd de roadmap in de gaten, maar plan er niets op. Claims over kaarten die er nog niet zijn, hebben een lange geschiedenis van tegenvallen. Het cijfer om over een jaar op terug te kijken, is niet de 500.000 kaarten per cluster, maar hoeveel van die 20 gigawatt er daadwerkelijk staat.