Alibaba zet de gewichten van Qwen3.8-Max volgende week open en heeft het model vandaag wereldwijd beschikbaar gemaakt via Alibaba Cloud Model Studio en agentplatform QwenWork, meldt het bedrijf.
Daarmee wordt een belofte die twee weken geleden nog zonder datum in de lucht hing ineens een inkoopvraag. Er komt een topmodel dat je in principe zelf mag draaien, en de gepubliceerde prijs van de gehoste versie duikt fors onder die van de Amerikaanse concurrentie. Op Alibaba's eigen Qwen Cloud kost het model 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens, tegen 5 en 25 dollar voor Anthropic's Claude Opus 5. Voor een bedrijf dat nu een AI-abonnement of API-budget vastlegt, is dat het verschil tussen een post van enkele honderden en enkele duizenden euro's per maand.
Wat er sinds 19 juli veranderde
Op 19 juli was Qwen 3.8 nog een betaalde preview waarbij open gewichten alleen "binnenkort" waren beloofd, zonder datum en zonder licentie. Twee gaten zijn nu gedicht. Alibaba Cloud maakte op zijn eigen kanaal bekend dat de gewichten van Qwen3.8-Max volgende week vrijkomen, samen met een veel kleinere Qwen3.8-27B. En het aantal actieve parameters is eindelijk bekend: het model gebruikt een mixture-of-experts-opzet die per verzoek maar 95 miljard van de 2,4 biljoen parameters aanzet, wat kosten en wachttijd drukt.
Dat cijfer was tot vandaag geheim, en het is precies het getal dat bepaalt of zelf draaien haalbaar is. Wat nog steeds ontbreekt: onder welke licentie de gewichten uitkomen. Vorige open Qwen-modellen stonden onder Apache 2.0, maar voor deze release heeft Alibaba dat niet bevestigd.
Het model is multimodaal en verwerkt tot een miljoen tokens per keer, genoeg voor een compleet contractarchief of een middelgrote codebase in één sessie. Het is volgens Alibaba gebouwd voor autonoom coderen en langlopende agenttaken; het bedrijf claimt dat het model een software-engineeringproject van zestien dagen zelfstandig afmaakte. Op het crowdsourcede vergelijkingsplatform Arena.AI werd Qwen3.8-Max meteen het hoogst geplaatste Chinese tekstmodel, al blijft het achter Claude Fable 5 en drie Opus-varianten. Op de ranglijst voor modellen die beeld analyseren staat het tweede wereldwijd.
Wat zelf hosten echt betekent
Voor het vlaggenschip zelf is "zelf draaien" voorlopig theorie. Bij 2,4 biljoen parameters praat je zelfs met agressieve 8-bits kwantisatie over grofweg 2,4 terabyte aan gewichten die in geheugen moeten passen. Dat zijn tientallen versnellers uit de duurste klasse, een investering waar geen enkel Nederlands MKB-bedrijf aan begint voor een chatfunctie. Voeg daar de stroomrekening en het beheer bij en de gehoste API blijft voor vrijwel iedereen de goedkopere route.
De interessante release is daarom de Qwen3.8-27B die tegelijk vrijkomt. Zevenentwintig miljard parameters past bij vier- of achtbits kwantisatie op één serieuze videokaart, en dat is hardware die je koopt of huurt zonder investeringscommissie. Daar wordt zelf hosten een echte optie: het model staat op je eigen server of bij een Europese aanbieder, je data verlaat je omgeving niet, en de kosten zijn een vast bedrag per maand in plaats van een teller die met je gebruik meeloopt.

Eén nuchtere controle voor wie dit al inplant: op Hugging Face staat vandaag nog geen enkel Qwen3.8-gewichtenbestand. Tot ze er daadwerkelijk staan, is zelf draaien een aankondiging en geen mogelijkheid. Wie de gehoste route neemt en toch aan Europese dataplaatsing moet voldoen, heeft wel een tussenweg: Alibaba Cloud Model Studio draait behalve in Singapore en Peking ook in een Duitse regio in Frankfurt, waar je een bereik kunt instellen waarbinnen je data blijft. Dat lost de vraag onder welke jurisdictie het model gemaakt is niet op, maar het scheelt wel de reis naar een Chinese datacentrum.
Waar de prijsdruk vandaan komt
Het tempo is opvallender dan dit ene model. Qwen3.8-Max komt kort na Moonshots Kimi K3 met 2,8 biljoen parameters, een model dat draait op ongeveer 20.000 Nvidia-chips die Moonshot huurt bij Alibaba. Zolang Chinese labs om de paar weken een frontier-claim lanceren en de gewichten er daarna bij leggen, staat de prijs van gesloten Amerikaanse modellen onder blijvende druk. Dat merk je op elk AI-budget, ook als je nooit een Chinees model aanzet: concurrentie op de bovenkant van de markt drukt de tarieven eronder.
De kanttekening is dezelfde als bij elke Chinese open release, en ze is de laatste weken groter geworden in plaats van kleiner. Open gewichten halen de leveranciersgreep weg, maar niet de jurisdictie waaronder het model is gemaakt. En Beijing weegt inmiddels exportcontroles waarbij ook het downloaden van modelgewichten in beeld komt. Een bestand dat je vandaag mag ophalen, is daarmee geen garantie voor volgend jaar.
De echte verschuiving zit in wat Alibaba met deze stap over zichzelf zegt. Het bedrijf hield zijn zwaarste Max-modellen tot nu toe consequent gesloten en breekt daar nu mee. Dat maakt van open gewichten geen achterhoedegevecht van kleinere labs meer, maar een keuze die de grootste Chinese cloudpartij bewust maakt om ontwikkelaars naar zich toe te trekken. Wie een model kiest voor de komende twee jaar, koopt dus geen product maar een positie in een markt die om de maand van vorm verandert. Het antwoord daarop is niet het beste model uitzoeken, maar zorgen dat het model in je eigen opzet een vervangbaar onderdeel is.
Veelgestelde vragen
Een model dat vervangbaar blijft
Of je nu een Chinees open model zelf host of bij een Amerikaanse aanbieder afneemt: ik zorg dat de keuze omkeerbaar blijft. Ik denk mee over de opzet, ontwerp de werkwijze en bouw en automatiseer hem ook, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
