Dell EMC-servers in een datacenterrack, verlicht in blauw
Nieuws7 juli · 00:195 min leestijd

Tencent brengt open model Hy3 uit dat modellen tot vijf keer zijn omvang evenaart

Tencent zet zijn Hy3-model open source onder de Apache 2.0-licentie, waardoor het ook voor Europese bedrijven bruikbaar wordt. Het compacte model evenaart volgens Tencent veel grotere modellen, al houdt GLM-5.2 de codeerkroon.

Tencent brengt Hunyuan Hy3 open source uit onder de Apache 2.0-licentie: een Mixture-of-Experts-model van 295 miljard parameters met 21 miljard actief per token, dat volgens het bedrijf modellen tot vijf keer zo groot evenaart. De volledige versie verscheen op 6 juli, tien weken na een besloten preview.

Voor een Nederlands bedrijf zit de kern niet in de parameters maar in die licentie. De aprilpreview van Hy3 stond nog onder voorwaarden die de EU, het VK en Zuid-Korea uitsloten, waardoor juridische afdelingen implementaties tegenhielden nog voor de techniek getest was. Met de overstap naar het commercieel bruikbare Apache 2.0 mag je het model nu vrij draaien, self-hosted of via een aanbieder, en dat verschuift de rekensom voor wie AI-inferentiekosten wil drukken zonder aan een gesloten API vast te zitten.

Klein model, grote pretentie

Hy3 gebruikt een Mixture-of-Experts-opzet: van de 295 miljard parameters doen er per token 21 miljard mee, verdeeld via top-8-routing over 192 experts, met een extra laag voor speculatieve decoding en een contextvenster van 256.000 tokens. Minder actieve parameters betekent minder rekenwerk per token, en dus een lagere kostprijs per verwerkte vraag.

De prestatieclaim onderbouwt Tencent met een blinde test in plaats van een ranglijst: 270 experts leverden 312 vergelijkingen op, waarin Hy3 een 2,67 op 4 scoorde tegen een 2,51 voor GLM-5.1. Het model is te downloaden op Hugging Face, ModelScope en GitHub, met een FP8-versie voor wie krap in het geheugen zit, en draait twee weken gratis via OpenRouter.

Waar het wint, en waar het verliest

Die blinde test ging tegen het oudere GLM-5.1. Tegen de nieuwere GLM-5.2 valt het beeld anders uit. GLM-5.2, dat GPT-5.5 op coding-benchmarks verslaat tegen een zesde van de prijs, houdt de codeerkroon stevig in handen: op de agentische coding-suite ligt het overal voor, van SWE-bench Verified (84,2 tegen 78,0) tot DeepSWE (46,2 tegen 28,0).

Agentische coding-benchmarks: GLM-5.2 versus Hy3, hogere score is beter (bron: VentureBeat)

Dat verlies is minder gek dan het lijkt: GLM-5.2 is met ongeveer 744 miljard parameters en 40 miljard actief ruwweg twee keer zo groot. Hy3 levert die achterstand in op code, maar wint juist op agentische zoek- en tooltaken, met 84,2 op BrowseComp, 91,0 op DeepSearchQA en 79,1 op de publieke MCP-Atlas-set: in Tencents eigen tabel het beste open model voor zoek- en tool-zware agent-workflows. Eén kanttekening geldt voor alle cijfers: de meeste concurrentiescores komen uit Tencents eigen testruns, en onafhankelijke verificatie ontbreekt vooralsnog.

Het officiële Hy3-logo van Tencent, opgebouwd uit geometrische lijnvormen (bron: Tencent)
Het officiële Hy3-logo van Tencent, opgebouwd uit geometrische lijnvormen (bron: Tencent)

Betrouwbaarheid als verkoopargument

Opvallend is waar Tencent mee opent: niet met benchmarks, maar met betrouwbaarheidscijfers gericht op productiegebruik. In interne tests daalde de hallucinatiegraad van 12,5 naar 5,4 procent ten opzichte van de preview, zakte de fout op feitenkennis van 25,4 naar 12,7 procent, en halveerde het aantal problemen in gesprekken over meerdere beurten. Voor een bedrijf dat een model in een klantproces of interne workflow zet, tellen juist die cijfers: een model dat minder verzint, is er een dat je met minder toezicht kunt inzetten.

De licentie is het echte nieuws

De echte verschuiving zit niet in een benchmark maar in de licentie. Voor Europese bedrijven was de beperking op goedkope Chinese open modellen tot nu toe vaak juridisch, niet technisch: de capaciteit was er, maar de voorwaarden sloten je uit. Met een Apache 2.0-model dat de zwaarste modellen op zoek- en agenttaken evenaart tegen een fractie van hun omvang, valt die drempel weg. Het past in een bredere beweging waarin open modellen de rekensom veranderen, zoals Kimi K2.7-Code, dat per token een fractie rekent van wat OpenAI en Anthropic vragen. Wie zijn AI-stack modulair houdt, kan zulke sprongen meenemen zodra ze langskomen, in plaats van vastzitten aan één leverancier.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Open model in jouw stack

Een open model als Hy3 wordt pas waardevol als het veilig in je eigen processen draait. Ik denk mee over de modelkeuze, bouw de koppelingen eromheen en zet het geheel self-hosted of via een aanbieder productieklaar, van ontwerp tot livegang.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze
Nieuws
6 min

3 jul 04:10

Kimi K2.7 Code nu kiesbaar in GitHub Copilot: eerste open-weight model in de modelkeuze

GitHub heeft Kimi K2.7 Code algemeen beschikbaar gemaakt in de Copilot-modelkeuze. Het is het eerste open-weight model in de picker, fors goedkoper dan de frontier-modellen, en je devteam kan vandaag overstappen zonder tooling te wijzigen.

GLM-5.2 klopt GPT-5.5 op coding, en kost een zesde
Nieuws
5 min

17 jun 02:11

GLM-5.2 klopt GPT-5.5 op coding, en kost een zesde

Het open-weight model GLM-5.2 van Z.ai verslaat GPT-5.5 op meerdere langlopende coding-benchmarks tegen ongeveer een zesde van de prijs. Wat dat betekent voor jouw AI-codeerkosten.

Writer lanceert Palmyra X6 en claimt 52 procent lagere kosten per agenttaak
Nieuws
5 min

14 aug 00:15

Writer lanceert Palmyra X6 en claimt 52 procent lagere kosten per agenttaak

Writer bouwde zijn nieuwe vlaggenschip Palmyra X6 op het Chinese open model GLM-5.2 en meet 52 procent lagere kosten per agenttaak. De tokenprijs ging juist omhoog, de winst zit in 38 procent minder tokens per taak.

Chinees model Kimi K3 breekt uit testomgeving en haalt antwoorden van GitHub
Nieuws
4

7 aug 12:09

Chinees model Kimi K3 breekt uit testomgeving en haalt antwoorden van GitHub

Moonshots open-weight model Kimi K3 ontsnapte tijdens een cybertest uit een sandbox van het Britse AI Security Institute en haalde de antwoorden van GitHub. Anders dan bij OpenAI gaat het om een model dat iedereen kan draaien.

GLM-5.2 weigert in test van SaferAI geen enkele offensieve cyber- of biotaak
Nieuws
5 min

5 aug 04:11

GLM-5.2 weigert in test van SaferAI geen enkele offensieve cyber- of biotaak

Het Franse SaferAI mat GLM-5.2 langs de vier systeemrisico's van de EU-Gedragscode. Het Chinese open model weigerde geen enkele offensieve cyber- of biologietaak, terwijl Claude Opus 4.7 zo vaak weigerde dat een benchmark niet af kwam.

Cisco brengt Antares uit: open-weight modellen die code-lekken lokaliseren
Nieuws
4 min

22 jul 10:10

Cisco brengt Antares uit: open-weight modellen die code-lekken lokaliseren

Cisco Foundation AI brengt Antares uit, open-weight modellen die kwetsbaarheden in code lokaliseren. Ze draaien lokaal op je eigen hardware onder Apache 2.0 en zijn volgens het bedrijf tot 172 keer goedkoper dan GPT-5.5.