Close-up van een grafische kaart, het type hardware waarop een open-weight model lokaal draait
Nieuws3 augustus · 06:125 min leestijd

Alibaba zet de gewichten van Qwen3.8-Max volgende week open

Alibaba maakt Qwen3.8-Max wereldwijd beschikbaar en zet de gewichten volgende week open, samen met een kleinere 27B-versie. Het gehoste model kost 2 dollar per miljoen invoertokens, ruim onder Claude Opus 5.

Alibaba zet de gewichten van Qwen3.8-Max volgende week open en heeft het model vandaag wereldwijd beschikbaar gemaakt via Alibaba Cloud Model Studio en agentplatform QwenWork, meldt het bedrijf.

Daarmee wordt een belofte die twee weken geleden nog zonder datum in de lucht hing ineens een inkoopvraag. Er komt een topmodel dat je in principe zelf mag draaien, en de gepubliceerde prijs van de gehoste versie duikt fors onder die van de Amerikaanse concurrentie. Op Alibaba's eigen Qwen Cloud kost het model 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens, tegen 5 en 25 dollar voor Anthropic's Claude Opus 5. Voor een bedrijf dat nu een AI-abonnement of API-budget vastlegt, is dat het verschil tussen een post van enkele honderden en enkele duizenden euro's per maand.

Wat er sinds 19 juli veranderde

Op 19 juli was Qwen 3.8 nog een betaalde preview waarbij open gewichten alleen "binnenkort" waren beloofd, zonder datum en zonder licentie. Twee gaten zijn nu gedicht. Alibaba Cloud maakte op zijn eigen kanaal bekend dat de gewichten van Qwen3.8-Max volgende week vrijkomen, samen met een veel kleinere Qwen3.8-27B. En het aantal actieve parameters is eindelijk bekend: het model gebruikt een mixture-of-experts-opzet die per verzoek maar 95 miljard van de 2,4 biljoen parameters aanzet, wat kosten en wachttijd drukt.

Dat cijfer was tot vandaag geheim, en het is precies het getal dat bepaalt of zelf draaien haalbaar is. Wat nog steeds ontbreekt: onder welke licentie de gewichten uitkomen. Vorige open Qwen-modellen stonden onder Apache 2.0, maar voor deze release heeft Alibaba dat niet bevestigd.

Het model is multimodaal en verwerkt tot een miljoen tokens per keer, genoeg voor een compleet contractarchief of een middelgrote codebase in één sessie. Het is volgens Alibaba gebouwd voor autonoom coderen en langlopende agenttaken; het bedrijf claimt dat het model een software-engineeringproject van zestien dagen zelfstandig afmaakte. Op het crowdsourcede vergelijkingsplatform Arena.AI werd Qwen3.8-Max meteen het hoogst geplaatste Chinese tekstmodel, al blijft het achter Claude Fable 5 en drie Opus-varianten. Op de ranglijst voor modellen die beeld analyseren staat het tweede wereldwijd.

Wat zelf hosten echt betekent

Voor het vlaggenschip zelf is "zelf draaien" voorlopig theorie. Bij 2,4 biljoen parameters praat je zelfs met agressieve 8-bits kwantisatie over grofweg 2,4 terabyte aan gewichten die in geheugen moeten passen. Dat zijn tientallen versnellers uit de duurste klasse, een investering waar geen enkel Nederlands MKB-bedrijf aan begint voor een chatfunctie. Voeg daar de stroomrekening en het beheer bij en de gehoste API blijft voor vrijwel iedereen de goedkopere route.

De interessante release is daarom de Qwen3.8-27B die tegelijk vrijkomt. Zevenentwintig miljard parameters past bij vier- of achtbits kwantisatie op één serieuze videokaart, en dat is hardware die je koopt of huurt zonder investeringscommissie. Daar wordt zelf hosten een echte optie: het model staat op je eigen server of bij een Europese aanbieder, je data verlaat je omgeving niet, en de kosten zijn een vast bedrag per maand in plaats van een teller die met je gebruik meeloopt.

Het llama.cpp webinterface draait een open Qwen-model lokaal op een eigen machine (bron: Georgi Gerganov en de GGML-auteurs / Wikimedia Commons, publiek domein)
Het llama.cpp webinterface draait een open Qwen-model lokaal op een eigen machine (bron: Georgi Gerganov en de GGML-auteurs / Wikimedia Commons, publiek domein)

Eén nuchtere controle voor wie dit al inplant: op Hugging Face staat vandaag nog geen enkel Qwen3.8-gewichtenbestand. Tot ze er daadwerkelijk staan, is zelf draaien een aankondiging en geen mogelijkheid. Wie de gehoste route neemt en toch aan Europese dataplaatsing moet voldoen, heeft wel een tussenweg: Alibaba Cloud Model Studio draait behalve in Singapore en Peking ook in een Duitse regio in Frankfurt, waar je een bereik kunt instellen waarbinnen je data blijft. Dat lost de vraag onder welke jurisdictie het model gemaakt is niet op, maar het scheelt wel de reis naar een Chinese datacentrum.

Waar de prijsdruk vandaan komt

Het tempo is opvallender dan dit ene model. Qwen3.8-Max komt kort na Moonshots Kimi K3 met 2,8 biljoen parameters, een model dat draait op ongeveer 20.000 Nvidia-chips die Moonshot huurt bij Alibaba. Zolang Chinese labs om de paar weken een frontier-claim lanceren en de gewichten er daarna bij leggen, staat de prijs van gesloten Amerikaanse modellen onder blijvende druk. Dat merk je op elk AI-budget, ook als je nooit een Chinees model aanzet: concurrentie op de bovenkant van de markt drukt de tarieven eronder.

De kanttekening is dezelfde als bij elke Chinese open release, en ze is de laatste weken groter geworden in plaats van kleiner. Open gewichten halen de leveranciersgreep weg, maar niet de jurisdictie waaronder het model is gemaakt. En Beijing weegt inmiddels exportcontroles waarbij ook het downloaden van modelgewichten in beeld komt. Een bestand dat je vandaag mag ophalen, is daarmee geen garantie voor volgend jaar.

De echte verschuiving zit in wat Alibaba met deze stap over zichzelf zegt. Het bedrijf hield zijn zwaarste Max-modellen tot nu toe consequent gesloten en breekt daar nu mee. Dat maakt van open gewichten geen achterhoedegevecht van kleinere labs meer, maar een keuze die de grootste Chinese cloudpartij bewust maakt om ontwikkelaars naar zich toe te trekken. Wie een model kiest voor de komende twee jaar, koopt dus geen product maar een positie in een markt die om de maand van vorm verandert. Het antwoord daarop is niet het beste model uitzoeken, maar zorgen dat het model in je eigen opzet een vervangbaar onderdeel is.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Een model dat vervangbaar blijft

Of je nu een Chinees open model zelf host of bij een Amerikaanse aanbieder afneemt: ik zorg dat de keuze omkeerbaar blijft. Ik denk mee over de opzet, ontwerp de werkwijze en bouw en automatiseer hem ook, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract
Signaal
8 min

28 jul 00:44

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract

In januari 2025 stond de regel er al: modelgewichten onder exportvergunning. Hij werd ingetrokken. Anderhalf jaar later doet Washington hetzelfde per brief, en Beijing bouwt het instrument na.

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba
Nieuws
4 min

31 jul 16:38

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba

Moonshot draait Kimi K3 op ongeveer 20.000 Nvidia-chips die het huurt via Alibaba, meldt Bloomberg. De rekenkracht achter het goedkope open model is geleend, bij een partij die tegelijk aandeelhouder en concurrent is.

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag
Signaal
7 min

27 jul 12:04

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag

In tien dagen greep iedereen naar dezelfde laag in de AI-keten, en dat was niet het model. Het schaarse goed blijkt de capaciteit om een model te serveren, en daar verschuift de macht nu naartoe.

Congrescommissies vragen DoorDash uitleg over Chinees model Kimi K2.6
Nieuws
4 min

1 aug 04:34

Congrescommissies vragen DoorDash uitleg over Chinees model Kimi K2.6

Twee commissies van het Amerikaanse Huis vragen DoorDash uitleg over het Chinese model Kimi K2.6. De aanleiding is een eigen benchmark waarin dat model beter scoorde dan de Amerikaanse opstelling, en ook nog goedkoper was.

China dreigt met tegenmaatregelen tegen Amerikaanse sancties om Kimi K3
Nieuws
4 min

28 jul 00:16

China dreigt met tegenmaatregelen tegen Amerikaanse sancties om Kimi K3

China's ministerie van Handel noemt de Amerikaanse sanctiedreiging rond Kimi K3 AI-hegemonisme en belooft alle noodzakelijke maatregelen. Voor Nederlandse teams die op het Chinese model bouwen, komt de druk nu van twee kanten tegelijk.

Witte Huis beschuldigt Moonshot AI van modeldiefstal voor Kimi K3
Nieuws
4 min

22 jul 20:12

Witte Huis beschuldigt Moonshot AI van modeldiefstal voor Kimi K3

Witte Huis-directeur Michael Kratsios beschuldigt het Chinese Moonshot AI ervan dat het Kimi K3 bouwde door Anthropics Fable-model te distilleren, en dat het daarvoor Nvidia-chips via Thailand gebruikte. Voor Nederlandse teams groeit het leveranciers- en jurisdictierisico.