Alibaba plant een Qwen-model van 5 tot 10 biljoen parameters, presenteert de Zhenwu V900 en mikt op meer dan 20 GW cloudcapaciteit in 2032, meldt Reuters.
Voor een Nederlandse organisatie verschuift daarmee vooral de inkoopvraag: modelkeuze wordt tegelijk een keuze voor hardware, cloudregio en leveringsketen. De roadmap zegt nog niet dat V900 of een model van 5 tot 10 biljoen parameters beschikbaar is, maar wel dat Alibaba zijn eigen stack van model tot datacenter bouwt.
Van model naar volledige stack
De aankondiging kwam op 22 september tijdens de Apsara Conference in Hangzhou. Alibaba zegt dat het Qwen-team werkt aan modelarchitectuur, data-optimalisatie en recursive self-improvement, met als doel complexere taken over langere tijd uit te voeren. Reuters meldt dat Qwen 4 al in training is en dat Qwen 4.5 en Qwen 5 in de roadmap tot 5 tot 10 biljoen parameters kunnen opschalen.
Dat is een forse stap boven het huidige vlaggenschip. Reuters zet Qwen3.8 Max op 2,4 biljoen parameters, hetzelfde model waarvan de open gewichten en de hardwaredrempel voor zelf hosten eerder zijn beschreven. De nieuwe schaal maakt duidelijk dat een groter model niet losstaat van de omgeving waarin het draait.
Eigen chip als volgende laag
T-Head, de chipdochter van Alibaba, introduceert de Zhenwu V900. Volgens Alibaba levert die drie keer de prestaties van de Zhenwu M890 en kan één cluster tot 500.000 kaarten ondersteunen voor training en inferentie. Reuters meldt dat de chip volgens een bedrijfsverklaring in het eerste kwartaal van 2027 in massaproductie en commercieel beschikbaar moet komen.
Alibaba zegt ook dat de bestaande M890-supernode modellen boven 2 biljoen parameters efficiënt kan laten draaien. Dat is een bedrijfsclaim, geen onafhankelijke benchmark. De praktische betekenis zit wel helder in de architectuur: Alibaba probeert model, chip, supernode, netwerk en inferentie-engine gezamenlijk te optimaliseren, zodat de keuze voor een model steeds meer samenvalt met de keuze voor een infrastructuur.
20 GW cloudcapaciteit in 2032
De derde laag is de cloud. Alibaba Cloud mikt op meer dan 20 GW aan wereldwijde datacentercapaciteit die het bedrijf in 2032 zelf exploiteert. Alibaba zegt dat de vraag naar AI uitzonderlijk sterk blijft en dat tekorten in de wereldwijde AI-datacenterketen de uitbreiding nu al afremmen. De eerste eigen AI-supernodes moeten dit kwartaal op commerciële schaal online komen.

Voor Nederlandse bedrijven is die 20 GW geen product dat je vandaag kunt inkopen. Het getal laat wel zien waar de cloudkeuze naartoe beweegt. Beschikbaarheid van modellen, geschikte versnellers, stroom, regio en datalokatie komen in één leveranciersvraag samen. Een model kan op papier aantrekkelijk zijn, terwijl de benodigde hardware of dienstregio niet beschikbaar is voor jouw toepassing.
De verschuiving zit daarom niet in één parametergetal. Alibaba presenteert een route waarin frontier-modellen, eigen chips en wereldwijde cloudcapaciteit één plan vormen. De 5 tot 10 biljoen parameters en 20 GW zijn nog roadmapclaims, geen geleverde capaciteit. De ontwikkeling maakt wel zichtbaar dat modelkeuze en infrastructuurkeuze steeds minder los van elkaar te beoordelen zijn.
Veelgestelde vragen
AI-infrastructuur die werkt
Ik help je de stap van AI-idee naar werkende keten maken: ik denk mee, ontwerp de architectuur en bouw en automatiseer het geheel, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

