Rijen zwarte serverracks met witte logo's in een datacenter
Nieuws28 augustus · 12:075 min leestijd

Tencent zet Hy4 preview open onder Apache 2.0 zonder uitgesloten gebieden

Tencent zet Hy4 preview open onder Apache 2.0 zonder uitgesloten gebieden. Het licentiebestand is schoon en er is geen toegangsformulier, maar met 1,56 terabyte aan gewichten blijft zelf hosten uitgesloten en verschuift de keuze naar de API.

Tencent zet Hy4 preview open onder Apache 2.0, meldt het bedrijf op Hugging Face: een Mixture-of-Experts-model van 770 miljard parameters met 49 miljard actief per token en een contextvenster van 1 miljoen tokens.

Voor een Nederlands bedrijf zit het nieuws in het licentiebestand, niet in de benchmark. Dat bestand bevat de kale Apache 2.0-tekst en noemt geen enkel uitgesloten gebied, en de gewichten staan klaar zonder toegangsformulier. Commercieel gebruik binnen de EU mag dus vanaf dag een. Alleen kan vrijwel geen enkel bedrijf dit model zelf draaien, waardoor de vraag verschuift van waar je het neerzet naar welke API je aanroept en waar je prompts landen.

Schoon gelicentieerd, maar niet te tillen

Dat de licentie schoon is, spreekt bij deze modelfamilie niet vanzelf. De aprilpreview van de vorige generatie sloot de EU, het VK en Zuid-Korea nog expliciet uit, waardoor juridische afdelingen afhaakten voordat er iets getest was. Bij Hy4 preview ontbreekt die clausule volledig en is er ook geen goedkeuringsstap voor de download.

De rem zit nu in de hardware. De gewichten beslaan 131 bestanden van samen 1,56 terabyte, en de FP8-variant komt nog altijd op 814 gigabyte. Tencents eigen vLLM-recept start het model met acht GPU's tensor-parallel, en dat geldt voor die FP8-versie, nog zonder het geheugen dat een context van 1 miljoen tokens opeet. Voor een MKB'er of een middelgrote IT-afdeling is zelf hosten daarmee geen optie, hoe open de licentie ook is.

De rekensom verschuift naar de API

Tencent zet het model dan ook meteen op zijn eigen infrastructuur. Via TokenHub kost Hy4 preview 0,834 dollar per miljoen invoertokens en 2,501 dollar per miljoen uitvoertokens, met 0,042 dollar voor een cache-hit en tot 1 miljoen gratis tokens die 90 dagen geldig blijven. Op OpenRouter verscheen het model vanochtend voor precies dezelfde prijs, met Tencent zelf als enige aanbieder, in FP8 en met een limiet van 64.000 uitvoertokens per antwoord.

Dat is fors duurder dan de vorige generatie. Hy3 staat op OpenRouter op 0,13 dollar per miljoen invoertokens en 0,53 dollar per miljoen uitvoertokens. Hy4 preview vraagt daarmee ruim zes keer zoveel voor invoer en bijna vijf keer zoveel voor uitvoer. Wie Hy3 in een agent-workflow heeft draaien, ruilt een capaciteitssprong dus in tegen een rekening die in dezelfde beweging vervijfvoudigt.

Zwaarder dan de prijs weegt de vraag waar het verkeer heen gaat. TokenHub bedient dit model vanuit de regio Singapore, en bij de vorige generatie meldde het privacybeleid van WorkBuddy al opslag in Singapore met mogelijke toegang door teams in China. Via OpenRouter blijft die vraag even scherp, want dat platform maakt het aanzetten van een model zo makkelijk dat het een leverancierskeuze wordt zonder inkoopmoment of verwerkersovereenkomst. Een Apache 2.0-licentie zegt niets over wat er met je invoer gebeurt zodra die naar de server van een ander gaat.

Wat het model kan, volgens Tencent zelf

De sprong ten opzichte van Hy3 is in Tencents eigen tabel groot. Op Terminal-Bench 2.1 gaat de score van 70,8 naar 85,4, op DeepSWE van 28,0 naar 64,3, op Toolathlon-Verified van 56,2 naar 74,1 en op SWE-Marathon van 5,0 naar 31,9.

Tegen de gesloten top blijft het beeld genuanceerder. In diezelfde grafiek evenaart Hy4 preview op Terminal-Bench 2.1 Claude Opus 5 met 85,4, terwijl GPT 5.6 Sol en GLM 5.3 op 88,3 blijven staan. Op Humanity's Last Exam zonder tools komt het model op 43,4, achter Claude Opus 5 (53,2) en GPT 5.6 Sol (49,6). In een blinde test lieten 163 interne experts over 203 engineeringtaken het model uitkomen op 2,99 van de 4, tegen 2,92 voor GLM 5.3 en 2,94 voor Kimi K3. Twee kanttekeningen horen erbij: die test is intern, en de concurrentiescores met een sterretje in Tencents tabel komen uit zijn eigen testruns, niet uit onafhankelijke metingen.

Tencent noemt de release zelf een vroege versie en somt de bekende gebreken op: het model denkt te lang door op complexe taken en controleert zijn eigen werk te vaak. De preview werkt ook nog alleen met tekst, zonder beeldverwerking. AIBase meldt dat het model bij de release meteen in CodeBuddy, WorkBuddy, Yuanbao en ima is gezet.

De grens verschuift van juridisch naar fysiek

Een jaar geleden was de blokkade voor Chinese open modellen in Europa vooral een stuk tekst: een licentie die je gebied uitsloot. Die tekst is nu schoon, bij Tencent en bij meer aanbieders. Wat ervoor in de plaats komt is een harde fysieke grens, want een open model van 770 miljard parameters past niet meer in een serverruimte die je zelf beheert. Open gewichten gaan daarmee steeds minder over zelf draaien en steeds meer over het recht om te inspecteren, te finetunen en van aanbieder te wisselen. Wie op die drie punten inkoopt, houdt de winst van open modellen vast. Wie erop rekende dat open ook zelf gehost betekent, ziet die optie bij elke nieuwe generatie verder wegzakken.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Model kiezen zonder lock-in

Een open licentie helpt je pas als je stack van aanbieder kan wisselen zonder dat je alles opnieuw bouwt. Ik denk met je mee over die keuze, ontwerp de architectuur eromheen en realiseer en automatiseer het geheel, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Tencent stelt Hy3 wereldwijd beschikbaar via WorkBuddy en Tencent Cloud
Nieuws
5 min

5 aug 10:37

Tencent stelt Hy3 wereldwijd beschikbaar via WorkBuddy en Tencent Cloud

Tencent maakt Hy3 wereldwijd afneembaar via WorkBuddy, Miora en TokenHub. De licentie sluit geen enkel gebied uit, maar het privacybeleid van WorkBuddy zet je gegevens op servers in Singapore, met toegang vanuit China.

Z.ai brengt GLM-5.3 uit en houdt de gewichten twee weken achter
Nieuws
5 min

14 aug 12:10

Z.ai brengt GLM-5.3 uit en houdt de gewichten twee weken achter

Z.ai bracht GLM-5.3 uit via zijn API, maar de gewichten volgen pas over twee weken omdat de post-training onverwacht sterke exploitvaardigheden opleverde. Zelf hosten kan dus nog niet, meelopen via een Chinese API wel.

Welk open-weight AI-model past bij jouw bedrijf: vergelijking en stappenplan
Gids
9 min

20 jun 19:05

Welk open-weight AI-model past bij jouw bedrijf: vergelijking en stappenplan

Er zijn opeens tien capabele open-weight modellen en ze claimen allemaal de beste te zijn. Dit is hoe je in een halve dag de juiste kiest voor jouw taak, budget en data-eisen.

Drie runs met een goedkoop AI-model vinden meer lekken dan één dure run
Nieuws
5 min

21 aug 12:22

Drie runs met een goedkoop AI-model vinden meer lekken dan één dure run

Aikido verbrandde 11,7 miljard tokens om tien AI-modellen op 32 verse CVE's te testen. Drie runs DeepSeek V4 Pro kosten 295 dollar en vinden er 28, meer dan een enkele pass van Opus 5 of Grok 4.6.

Alibaba publiceert Qwen3.8-licentie met drempel van 50 miljoen dollar
Nieuws
5 min

13 aug 16:16

Alibaba publiceert Qwen3.8-licentie met drempel van 50 miljoen dollar

Alibaba publiceerde de licentie bij Qwen3.8-Max. Boven 50 miljoen dollar omzet uit een model-als-dienst of AI-werkassistent is vooraf een aparte overeenkomst nodig. Intern gebruik blijft vrij, maar Apache 2.0 is het niet meer.

DeepSeek brengt V4-Pro uit preview en houdt de tarieven gelijk
Nieuws
5 min

13 aug 06:10

DeepSeek brengt V4-Pro uit preview en houdt de tarieven gelijk

DeepSeek zet V4-Pro als officiële versie op zijn API, onder dezelfde modelnaam en tegen hetzelfde tarief. Er kwam geen aankondiging bij, de gewichten blijven voorlopig de preview en de aangekondigde prijsverhoging staat nog op dezelfde pagina.