Tencent zet Hy4 preview open onder Apache 2.0, meldt het bedrijf op Hugging Face: een Mixture-of-Experts-model van 770 miljard parameters met 49 miljard actief per token en een contextvenster van 1 miljoen tokens.
Voor een Nederlands bedrijf zit het nieuws in het licentiebestand, niet in de benchmark. Dat bestand bevat de kale Apache 2.0-tekst en noemt geen enkel uitgesloten gebied, en de gewichten staan klaar zonder toegangsformulier. Commercieel gebruik binnen de EU mag dus vanaf dag een. Alleen kan vrijwel geen enkel bedrijf dit model zelf draaien, waardoor de vraag verschuift van waar je het neerzet naar welke API je aanroept en waar je prompts landen.
Schoon gelicentieerd, maar niet te tillen
Dat de licentie schoon is, spreekt bij deze modelfamilie niet vanzelf. De aprilpreview van de vorige generatie sloot de EU, het VK en Zuid-Korea nog expliciet uit, waardoor juridische afdelingen afhaakten voordat er iets getest was. Bij Hy4 preview ontbreekt die clausule volledig en is er ook geen goedkeuringsstap voor de download.
De rem zit nu in de hardware. De gewichten beslaan 131 bestanden van samen 1,56 terabyte, en de FP8-variant komt nog altijd op 814 gigabyte. Tencents eigen vLLM-recept start het model met acht GPU's tensor-parallel, en dat geldt voor die FP8-versie, nog zonder het geheugen dat een context van 1 miljoen tokens opeet. Voor een MKB'er of een middelgrote IT-afdeling is zelf hosten daarmee geen optie, hoe open de licentie ook is.
De rekensom verschuift naar de API
Tencent zet het model dan ook meteen op zijn eigen infrastructuur. Via TokenHub kost Hy4 preview 0,834 dollar per miljoen invoertokens en 2,501 dollar per miljoen uitvoertokens, met 0,042 dollar voor een cache-hit en tot 1 miljoen gratis tokens die 90 dagen geldig blijven. Op OpenRouter verscheen het model vanochtend voor precies dezelfde prijs, met Tencent zelf als enige aanbieder, in FP8 en met een limiet van 64.000 uitvoertokens per antwoord.
Dat is fors duurder dan de vorige generatie. Hy3 staat op OpenRouter op 0,13 dollar per miljoen invoertokens en 0,53 dollar per miljoen uitvoertokens. Hy4 preview vraagt daarmee ruim zes keer zoveel voor invoer en bijna vijf keer zoveel voor uitvoer. Wie Hy3 in een agent-workflow heeft draaien, ruilt een capaciteitssprong dus in tegen een rekening die in dezelfde beweging vervijfvoudigt.
Zwaarder dan de prijs weegt de vraag waar het verkeer heen gaat. TokenHub bedient dit model vanuit de regio Singapore, en bij de vorige generatie meldde het privacybeleid van WorkBuddy al opslag in Singapore met mogelijke toegang door teams in China. Via OpenRouter blijft die vraag even scherp, want dat platform maakt het aanzetten van een model zo makkelijk dat het een leverancierskeuze wordt zonder inkoopmoment of verwerkersovereenkomst. Een Apache 2.0-licentie zegt niets over wat er met je invoer gebeurt zodra die naar de server van een ander gaat.
Wat het model kan, volgens Tencent zelf
De sprong ten opzichte van Hy3 is in Tencents eigen tabel groot. Op Terminal-Bench 2.1 gaat de score van 70,8 naar 85,4, op DeepSWE van 28,0 naar 64,3, op Toolathlon-Verified van 56,2 naar 74,1 en op SWE-Marathon van 5,0 naar 31,9.
Tegen de gesloten top blijft het beeld genuanceerder. In diezelfde grafiek evenaart Hy4 preview op Terminal-Bench 2.1 Claude Opus 5 met 85,4, terwijl GPT 5.6 Sol en GLM 5.3 op 88,3 blijven staan. Op Humanity's Last Exam zonder tools komt het model op 43,4, achter Claude Opus 5 (53,2) en GPT 5.6 Sol (49,6). In een blinde test lieten 163 interne experts over 203 engineeringtaken het model uitkomen op 2,99 van de 4, tegen 2,92 voor GLM 5.3 en 2,94 voor Kimi K3. Twee kanttekeningen horen erbij: die test is intern, en de concurrentiescores met een sterretje in Tencents tabel komen uit zijn eigen testruns, niet uit onafhankelijke metingen.
Tencent noemt de release zelf een vroege versie en somt de bekende gebreken op: het model denkt te lang door op complexe taken en controleert zijn eigen werk te vaak. De preview werkt ook nog alleen met tekst, zonder beeldverwerking. AIBase meldt dat het model bij de release meteen in CodeBuddy, WorkBuddy, Yuanbao en ima is gezet.
De grens verschuift van juridisch naar fysiek
Een jaar geleden was de blokkade voor Chinese open modellen in Europa vooral een stuk tekst: een licentie die je gebied uitsloot. Die tekst is nu schoon, bij Tencent en bij meer aanbieders. Wat ervoor in de plaats komt is een harde fysieke grens, want een open model van 770 miljard parameters past niet meer in een serverruimte die je zelf beheert. Open gewichten gaan daarmee steeds minder over zelf draaien en steeds meer over het recht om te inspecteren, te finetunen en van aanbieder te wisselen. Wie op die drie punten inkoopt, houdt de winst van open modellen vast. Wie erop rekende dat open ook zelf gehost betekent, ziet die optie bij elke nieuwe generatie verder wegzakken.
Veelgestelde vragen
Model kiezen zonder lock-in
Een open licentie helpt je pas als je stack van aanbieder kan wisselen zonder dat je alles opnieuw bouwt. Ik denk met je mee over die keuze, ontwerp de architectuur eromheen en realiseer en automatiseer het geheel, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
