Computerscherm met HTML-code van een webontwikkelingsproject.
Nieuws3 september · 04:344 leestijd

Alibaba scherpt Qwen3.8-Max aan voor code en houdt de prijs gelijk

Alibaba brengt Qwen3.8-Max-0902 uit, een codeversie van zijn topmodel tegen ongewijzigde tarieven van 2 en 6 dollar per miljoen tokens. De geclaimde eerste plek op Arena hield precies één dag stand.

Alibaba brengt Qwen3.8-Max-0902 uit, een bijgetrainde momentopname van zijn vlaggenschipmodel die volgens het bedrijf 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens blijft kosten.

Voor een Nederlands team dat een codeeragent per token afrekent, verschuift dat de bovenkant van de prijslijst. Op de webontwikkelingsranglijst van Arena staat de nieuwe snapshot met 1688 punten één punt boven Claude Opus 5 in zijn zwaarste instelling, een model waarvoor Anthropic 5 dollar invoer en 25 dollar uitvoer per miljoen tokens rekent. Vrijwel dezelfde score dus, voor 40 procent van de invoerprijs en een kwart van de uitvoerprijs.

De koppositie hield één dag

Arena presenteerde de snapshot op 2 september als debutant op de eerste plek met 1691 punten, 22 punten boven de vorige Qwen3.8-Max en 3 punten boven Claude Opus 5. Een dag later staat Qwen3.8-Max-0902 op diezelfde ranglijst tweede, met 1688 punten, achter claude-fable-5.1-max op 1765. De afstand tot Claude Opus 5 is dan één punt, bij een gepubliceerde foutmarge van plus en min 18 punten en een rangorde die volgens de tabel zelf ergens tussen plaats twee en plaats vijf ligt.

Die beweeglijkheid hoort bij het instrument. De lijst draait op bijna 641.000 stemmen over 124 modellen, en een model met 1.472 stemmen schuift sneller dan een model met 10.583. De lijst meet bovendien één ding: agentische frontend-taken, oftewel het afleveren van webapplicaties, niet codeerwerk in de volle breedte. Wie een codeermodel op één ranglijst uitkiest, loopt tegen hetzelfde probleem aan dat OpenAI in juli zelf benoemde toen het zijn aanbeveling van SWE-Bench Pro introk omdat een eigen audit de resultaten misleidend noemde.

Wat er wel en niet in de snapshot zit

Het model houdt 2,4 biljoen parameters en een contextvenster van een miljoen tokens. De bijtraining richtte zich op programmeren en Cowork-taken, Alibaba's noemer voor kantoorwerk waarin het model meerdere stappen achter elkaar zet. QwenCloud noemt daarnaast scherper redeneren over grafieken en het uitlezen van documenten, een maximale invoer van 991.000 tokens per verzoek en een uitvoerplafond van 131.000 tokens.

Wat ontbreekt, zijn cijfers. Alibaba publiceert bij deze momentopname geen nieuwe codeer-, agent- of visiescores, alleen kwalitatieve claims plus de uitslag uit de arena. Het prijsblad blijft eveneens ongewijzigd, inclusief de cachetarieven van 0,17 dollar per miljoen tokens bij een expliciete treffer en 0,25 dollar bij een impliciete. Voor een agent die bij elke beurt dezelfde systeemprompt en codebase meestuurt, bepaalt juist dat tarief het grootste deel van de rekening.

Waar je prompts landen

Alibaba noemt één route naar het model: de API op QwenCloud. Dat platform staat op naam van Intelligent Cloud Computing (Singapore) Private Limited, een Singaporese entiteit, niet van een Europese vestiging. Wie dataplaatsing binnen de EU moet kunnen aantonen, komt uit bij Alibaba's andere route: Model Studio publiceert endpoints per regio, waaronder eu-central-1 in Frankfurt, met de kanttekening dat een API-sleutel bij de regio en het afrekenplan van dat endpoint moet horen. Of de 0902-snapshot daar al draait, maakt Alibaba niet duidelijk; de aankondiging noemt uitsluitend QwenCloud.

De webinterface van Qwen met de modelkiezer linksboven, hier op een eerdere modelversie (bron: Aliharchick / Wikimedia Commons, CC BY-SA 4.0)
De webinterface van Qwen met de modelkiezer linksboven, hier op een eerdere modelversie (bron: Aliharchick / Wikimedia Commons, CC BY-SA 4.0)

De echte verschuiving zit niet in de koppositie, die morgen alweer anders kan staan, maar in de spreiding eronder. Op dezelfde ranglijst staat het veel kleinere Qwen3.8-Flash-Next, waarvan de gehoste variant ongeveer een twaalfde van het vlaggenschip kost, op plaats tien met 1622 punten. Tussen de top en dat model zit een factor twaalf in prijs en minder dan vier procent in score. Een maand geleden was Qwen3.8-Max op Arena vooral het hoogst geplaatste Chinese tekstmodel, met de Amerikaanse top nog buiten bereik. Die afstand is nu een kwestie van punten in plaats van klassen, en daarmee wordt modelkeuze minder een prestatievraag en meer een vraag over prijs, herhaalbaarheid en jurisdictie.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Modelkeuze zonder gokwerk

Welk model je codeeragent draait, is net zo goed een vraag over kosten en jurisdictie als over punten op een ranglijst. Ik denk mee over die afweging, ontwerp de opzet en bouw en automatiseer het geheel, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Alibaba zet de gewichten van Qwen3.8-Max volgende week open
Nieuws
5 min

3 aug 06:12

Alibaba zet de gewichten van Qwen3.8-Max volgende week open

Alibaba maakt Qwen3.8-Max wereldwijd beschikbaar en zet de gewichten volgende week open, samen met een kleinere 27B-versie. Het gehoste model kost 2 dollar per miljoen invoertokens, ruim onder Claude Opus 5.

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens
Nieuws
5 min

27 aug 02:22

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens

Alibaba zet de gewichten van Qwen3.8-Flash-Next open. Het model activeert 6 van 176 miljard parameters per token, kost gehost 0,16 dollar per miljoen invoertokens en komt met een strakkere licentie dan het vlaggenschip.

Moonshot vraagt Microsoft, Amazon en Google tot 30 procent van de Kimi K3-omzet
Nieuws
4 min

26 aug 22:35

Moonshot vraagt Microsoft, Amazon en Google tot 30 procent van de Kimi K3-omzet

Moonshot vraagt volgens Reuters tot 30 procent van de omzet die Microsoft, Amazon en Google met Kimi K3 zouden maken. De gesprekken bepalen of je het Chinese topmodel straks gewoon als clouddienst inkoopt.

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen
Nieuws
5 min

23 aug 06:07

Nvidia wil met de Poolside-licentie een open-weight topmodel bouwen

Nvidia wil de licentiedeal van 6 miljard dollar met Poolside gebruiken om een van 's werelds krachtigste open-weight modellen te bouwen, meldt The Wall Street Journal. Wat dat verandert voor teams die nu op Chinese gewichten zelf hosten.

Alibaba's AI-lab verliest 2 miljard dollar, cloudtak verdient 830 miljoen
Nieuws
5 min

21 aug 08:24

Alibaba's AI-lab verliest 2 miljard dollar, cloudtak verdient 830 miljoen

Alibaba splitste zijn AI-activiteiten voor het eerst uit in de kwartaalcijfers. De modellentak verloor 2,04 miljard dollar, de clouddivisie verdiende 830 miljoen. Dat maakt zichtbaar wie de lage tokenprijzen van Qwen betaalt.

Ornith zet modelfamilie 1.5 open, van 9B tot 397B
Nieuws
6 min

20 aug 06:10

Ornith zet modelfamilie 1.5 open, van 9B tot 397B

Ornith zette de gewichten van modelfamilie 1.5 op Hugging Face, van 9 tot 397 miljard parameters onder een MIT-label. Het LICENSE-bestand waarnaar de modelkaarten verwijzen ontbreekt in alle drie de repositories.