Alibaba heeft Qwen 3.8 uitgebracht, een multimodaal AI-model van 2,4 biljoen parameters dat volgens het bedrijf “op één na Fable 5” presteert, maar voorlopig alleen als betaalde preview beschikbaar is.
Het is het tweede Chinese frontier-model in twee dagen. Een dag eerder bracht Moonshot Kimi K3 uit als het grootste open model ter wereld, met 2,8 biljoen parameters. Wie op AI-kosten let, ziet het bewijs zich opstapelen dat topprestaties niet meer aan één dure gesloten leverancier vastzitten. De kanttekening is alleen groot: Qwen 3.8 is vandaag geen gratis, zelf te draaien model, maar een betaalde preview, en de rangschikking komt van Alibaba zelf.
Een preview, nog geen open model
Qwen 3.8 draait nu als preview via Alibaba’s eigen diensten Token Plan, Qoder en QoderWork, tegen 10 procent van de normale prijs. Open gewichten zijn beloofd “binnenkort”, zonder datum. Zou Alibaba die echt vrijgeven, dan breekt het met zijn eigen gewoonte om de zwaarste Max-modellen gesloten te houden. Tot dat moment gebruik je een gehoste Chinese API, geen model dat op je eigen servers staat.
Wat de preview netto kost, blijft bovendien gissen: die 10 procent geldt tegenover een standaardtarief dat Alibaba niet noemt. Bij Kimi K3 weet je dat wél, daar liggen de open gewichten en een tarief van 3 dollar per miljoen invoertokens gewoon op tafel. Het model is verder Alibaba’s eerste multimodale Qwen boven de biljoen parameters en verwerkt tekst, beeld, video en documenten.
Opvallend: de rivaal waartegen Qwen 3.8 wordt afgezet, behoort deels tot Alibaba’s eigen portefeuille. Alibaba is een van de grootste investeerders in Moonshot, de maker van Kimi K3. De parameterrace onder Chinese labs speelt zich zo deels binnen één investeringsfamilie af.
De benchmark die er nog niet is
De claim “op één na Fable 5” klinkt sterk, maar Alibaba publiceerde geen onafhankelijke benchmarks om die rangschikking te onderbouwen. Ook het aantal actieve parameters, cruciaal bij een sparse Mixture-of-Experts-model als dit, houdt het bedrijf achter: die 2,4 biljoen is het totaal, niet wat er per vraag daadwerkelijk rekent. Ter vergelijking: voorganger Qwen 3.7-Max haalde 80,4 procent op de codeerbenchmark SWE-bench Verified; voor 3.8 zijn er nog geen cijfers.
Dat een Chinees model Fable 5 verslaat, is op zichzelf geen novum. In juni pakte GLM-5.2 de eerste plek op een blinde web-designbenchmark, boven Claude Fable 5. Het verschil zit in het bewijs: dat was een onafhankelijke, gecrowdsourcete ranglijst, geen persbericht van de maker.
Waar de beweging echt zit
De echte ontwikkeling is niet dit ene model, maar het tempo. Zolang Chinese labs om de dag een frontier-claim lanceren, staat de prijs van de dure gesloten modellen onder blijvende druk, en dat scheelt op elk AI-budget. Maar een goedkope Chinese preview is nog geen soevereiniteit. Open gewichten halen de leveranciersgreep weg, niet de jurisdictie waaronder het model gemaakt is, en Beijing weegt bovendien beperkingen op buitenlandse toegang tot zijn beste modellen. Wat je wél beschermt, is een opzet waarin het model een vervangbaar onderdeel is: dan verandert een nieuwe Qwen of Kimi je rekening, niet je afhankelijkheid.
Veelgestelde vragen
Kies niet het model, kies portabiliteit
Elke week een nieuw ‘goedkoper’ model: ik ontwerp en bouw je AI-stack zo dat het model een vervangbaar onderdeel is, van meedenken tot self-hosted realiseren en automatiseren, zodat je kunt wisselen zodra prijs of politiek verandert.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
