Serverrek met patchkabels in een donkere ruimte, verlicht door groen licht
Nieuws19 augustus · 06:094 leestijd

China laat eerste Nvidia H200-chips toe bij ByteDance en Tencent

Peking laat voor het eerst kleine partijen Nvidia H200-chips toe op het Chinese vasteland. ByteDance en Tencent kregen elk zo'n tienduizend stuks, terwijl Amerikaanse vergunningen aankopen tot honderdduizend per bedrijf toestaan.

Peking laat kleine partijen Nvidia H200-chips het Chinese vasteland op, meldt de Financial Times: ByteDance en Tencent kregen elk ongeveer tienduizend exemplaren, terwijl Washington aankopen tot honderdduizend per bedrijf toestaat.

Twintigduizend chips stellen op wereldschaal weinig voor, maar de vergunningen eronder wel. Gaan de ongeveer tien Chinese bedrijven met een Amerikaanse licentie hun quotum echt opnemen, dan komt er een claim van honderdduizenden H200's bij op precies de productie waar Europese kopers ook in de rij staan. Dat raakt de aanname onder menig Nederlands AI-budget: dat rekenkracht per token vanzelf goedkoper wordt zodra de schaarste afneemt. Die aanname struikelde deze zomer al toen de prijs van gereserveerde Nvidia-GPU-blokken bij AWS per 1 juli met ongeveer 20 procent omhoog ging.

Wat Peking precies toelaat

Peking staat de zendingen toe om zijn belangrijkste techbedrijven te helpen de achterstand op Amerikaanse rivalen in te lopen, schrijft de Financial Times. ByteDance en Tencent ontvingen de afgelopen weken elk ongeveer tienduizend H200's, en andere Chinese techbedrijven kunnen binnenkort vergelijkbare leveringen krijgen. Persbureau Reuters, dat het bericht overnam, kon het niet zelfstandig bevestigen; Nvidia reageerde niet op vragen.

Tegelijk stuurt Peking het grootste deel van de hardware weg van het vasteland. Regelgevers lieten de bedrijven weten dat ze de chips naar Hongkong mogen brengen en daar mogen laten draaien, omdat Hongkong buiten de douanegrens van het vasteland valt. Chinese teams krijgen de rekenkracht zo wel, maar hij staat niet in een datacenter op het vasteland.

De rem zat in Peking, niet in Washington

De Amerikaanse vergunningen liggen er al maanden. Washington blokkeerde H200-export in 2025, kondigde in december van dat jaar een gedeeltelijke versoepeling aan in ruil voor een kwart van de verkoopopbrengst, en gaf in mei ongeveer tien Chinese bedrijven groen licht, waaronder Alibaba, Tencent, ByteDance en JD.com, met Lenovo en Foxconn als goedgekeurde distributeurs. Daarna gebeurde er weinig, omdat de Chinese kopers zich inhielden nadat Peking hen had aangespoord in de binnenlandse industrie te investeren.

Op 14 juli vertelde Jeffrey Kessler, de Amerikaanse onderminister van Handel voor industrie en veiligheid, aan de buitenlandcommissie van het Huis van Afgevaardigden dat de leveringen begonnen waren, maar dat er tot dan toe slechts een zeer beperkt aantal H200's naar China was gegaan. Wat er nu verandert zit dus aan de Chinese invoerkant, niet aan de Amerikaanse exportkant.

Waarom juist de H200 je inferentierekening raakt

De H200 is vooral een geheugenkaart. Nvidia geeft hem 141 GB HBM3e-geheugen en 4,8 terabyte per seconde aan bandbreedte, bijna het dubbele geheugen en 1,4 keer de bandbreedte van de H100, goed voor ongeveer 1,9 keer meer doorvoer op Llama 2 70B. Dat is precies het werk waar de tokenprijs op rust: een groot model dat antwoorden uitserveert aan veel gebruikers tegelijk. Elke H200 die naar een Chinees datacenter gaat, is een kaart die niet bij een Europese aanbieder in een inferentiecluster belandt.

Nvidia HGX H200-bord met acht H200-GPU-modules op een zwarte achtergrond, bron: Nvidia
Nvidia HGX H200-bord met acht H200-GPU-modules op een zwarte achtergrond, bron: Nvidia

Peking houdt de deur op een kier voor zijn eigen chipmakers

De Hongkong-route is geen technisch detail maar beleid. Peking wil de vraag op het vasteland bij de binnenlandse chipindustrie houden, en die industrie staat er inmiddels naar: Huawei's Ascend 950 benadert de prestaties van de H200, terwijl Nvidia's aandeel in de Chinese AI-chipmarkt dit jaar naar zo'n 8 procent zakt tegen ongeveer 40 procent in 2025. Een land dat zijn eigen alternatief bijna op niveau heeft, laat de Amerikaanse chip binnen als aanvulling, niet als vervanging.

Daarmee staat de sluis nu aan twee kanten onder politieke controle. Washington bepaalt hoeveel H200's China mag kopen, Peking bepaalt hoeveel er binnenkomen en waar ze mogen draaien. Diezelfde tweerichtingsbeweging zag je in juli, toen Peking exportcontroles op zijn eigen AI-modellen en chiptechnologie verkende. Voor wie inferentie inkoopt betekent dat iets nuchters: de prijs van rekenkracht wordt niet meer alleen door vraag en aanbod gezet, maar door twee regeringen die aan dezelfde kraan draaien. Een meerjarenbudget dat op één prijslijn rust, leunt op een aanname die in Peking of Washington binnen een week kan kantelen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI die niet vastzit

Wat je AI kost, hangt af van chips en aanbieders waar je zelf geen knop voor hebt. Ik denk met je mee over die keuze, ontwerp de opzet en bouw hem ook, zodat je van model of leverancier kunt wisselen zonder alles opnieuw op te tuigen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

China overweegt exportcontroles op AI-modellen en chips
Nieuws
3 min

21 jul 10:25

China overweegt exportcontroles op AI-modellen en chips

China overweegt strengere exportcontroles op zowel zijn AI-modellen als zijn chips, meldt de Financial Times. Een verharding voorbij de eerdere toegangsbeperking, die bedrijven raakt die op goedkope Chinese open modellen zijn gaan bouwen.

FCC werkt aan importverbod op nieuwe Chinese optische transceivers
Nieuws
4 min

4 aug 22:10

FCC werkt aan importverbod op nieuwe Chinese optische transceivers

De Amerikaanse FCC werkt aan een importverbod op nieuwe modellen Chinese optische transceivers, de modules die data binnen datacenters over glasvezel verplaatsen. Reuters meldt het op basis van vier ingewijden. Er ligt nog geen besluit.

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba
Nieuws
4 min

31 jul 16:38

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba

Moonshot draait Kimi K3 op ongeveer 20.000 Nvidia-chips die het huurt via Alibaba, meldt Bloomberg. De rekenkracht achter het goedkope open model is geleend, bij een partij die tegelijk aandeelhouder en concurrent is.

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract
Signaal
8 min

28 jul 00:44

Exportcontrole op AI klimt de stack op: van chip naar model naar jouw contract

In januari 2025 stond de regel er al: modelgewichten onder exportvergunning. Hij werd ingetrokken. Anderhalf jaar later doet Washington hetzelfde per brief, en Beijing bouwt het instrument na.

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag
Signaal
7 min

27 jul 12:04

Washington, Beijing en Stripe grijpen alledrie naar dezelfde laag

In tien dagen greep iedereen naar dezelfde laag in de AI-keten, en dat was niet het model. Het schaarse goed blijkt de capaciteit om een model te serveren, en daar verschuift de macht nu naartoe.

OpenAI en Google leveren AI aan Chinese zwartelijst-bedrijven via Singapore
Nieuws
4 min

10 jul 22:24

OpenAI en Google leveren AI aan Chinese zwartelijst-bedrijven via Singapore

OpenAI en Google leverden geavanceerde AI-diensten aan Singaporese dochters van Alibaba, Baidu en Tencent, bedrijven die op een zwarte lijst van het Pentagon staan. Exportcontroles blijken poreus, en dat verandert je leveranciersrisico.