Serverrek met patchkabels in een donkere ruimte, verlicht door groen licht
Nieuws19 augustus · 06:094 leestijd

China laat eerste Nvidia H200-chips toe bij ByteDance en Tencent

Peking laat voor het eerst kleine partijen Nvidia H200-chips toe op het Chinese vasteland. ByteDance en Tencent kregen elk zo'n tienduizend stuks, terwijl Amerikaanse vergunningen aankopen tot honderdduizend per bedrijf toestaan.

Peking laat kleine partijen Nvidia H200-chips het Chinese vasteland op, meldt de Financial Times: ByteDance en Tencent kregen elk ongeveer tienduizend exemplaren, terwijl Washington aankopen tot honderdduizend per bedrijf toestaat.

Twintigduizend chips stellen op wereldschaal weinig voor, maar de vergunningen eronder wel. Gaan de ongeveer tien Chinese bedrijven met een Amerikaanse licentie hun quotum echt opnemen, dan komt er een claim van honderdduizenden H200's bij op precies de productie waar Europese kopers ook in de rij staan. Dat raakt de aanname onder menig Nederlands AI-budget: dat rekenkracht per token vanzelf goedkoper wordt zodra de schaarste afneemt. Die aanname struikelde deze zomer al toen de prijs van gereserveerde Nvidia-GPU-blokken bij AWS per 1 juli met ongeveer 20 procent omhoog ging.

Wat Peking precies toelaat

Peking staat de zendingen toe om zijn belangrijkste techbedrijven te helpen de achterstand op Amerikaanse rivalen in te lopen, schrijft de Financial Times. ByteDance en Tencent ontvingen de afgelopen weken elk ongeveer tienduizend H200's, en andere Chinese techbedrijven kunnen binnenkort vergelijkbare leveringen krijgen. Persbureau Reuters, dat het bericht overnam, kon het niet zelfstandig bevestigen; Nvidia reageerde niet op vragen.

Tegelijk stuurt Peking het grootste deel van de hardware weg van het vasteland. Regelgevers lieten de bedrijven weten dat ze de chips naar Hongkong mogen brengen en daar mogen laten draaien, omdat Hongkong buiten de douanegrens van het vasteland valt. Chinese teams krijgen de rekenkracht zo wel, maar hij staat niet in een datacenter op het vasteland.

De rem zat in Peking, niet in Washington

De Amerikaanse vergunningen liggen er al maanden. Washington blokkeerde H200-export in 2025, kondigde in december van dat jaar een gedeeltelijke versoepeling aan in ruil voor een kwart van de verkoopopbrengst, en gaf in mei ongeveer tien Chinese bedrijven groen licht, waaronder Alibaba, Tencent, ByteDance en JD.com, met Lenovo en Foxconn als goedgekeurde distributeurs. Daarna gebeurde er weinig, omdat de Chinese kopers zich inhielden nadat Peking hen had aangespoord in de binnenlandse industrie te investeren.

Op 14 juli vertelde Jeffrey Kessler, de Amerikaanse onderminister van Handel voor industrie en veiligheid, aan de buitenlandcommissie van het Huis van Afgevaardigden dat de leveringen begonnen waren, maar dat er tot dan toe slechts een zeer beperkt aantal H200's naar China was gegaan. Wat er nu verandert zit dus aan de Chinese invoerkant, niet aan de Amerikaanse exportkant.

Waarom juist de H200 je inferentierekening raakt

De H200 is vooral een geheugenkaart. Nvidia geeft hem 141 GB HBM3e-geheugen en 4,8 terabyte per seconde aan bandbreedte, bijna het dubbele geheugen en 1,4 keer de bandbreedte van de H100, goed voor ongeveer 1,9 keer meer doorvoer op Llama 2 70B. Dat is precies het werk waar de tokenprijs op rust: een groot model dat antwoorden uitserveert aan veel gebruikers tegelijk. Elke H200 die naar een Chinees datacenter gaat, is een kaart die niet bij een Europese aanbieder in een inferentiecluster belandt.

Nvidia HGX H200-bord met acht H200-GPU-modules op een zwarte achtergrond, bron: Nvidia
Nvidia HGX H200-bord met acht H200-GPU-modules op een zwarte achtergrond, bron: Nvidia

Peking houdt de deur op een kier voor zijn eigen chipmakers

De Hongkong-route is geen technisch detail maar beleid. Peking wil de vraag op het vasteland bij de binnenlandse chipindustrie houden, en die industrie staat er inmiddels naar: Huawei's Ascend 950 benadert de prestaties van de H200, terwijl Nvidia's aandeel in de Chinese AI-chipmarkt dit jaar naar zo'n 8 procent zakt tegen ongeveer 40 procent in 2025. Een land dat zijn eigen alternatief bijna op niveau heeft, laat de Amerikaanse chip binnen als aanvulling, niet als vervanging.

Daarmee staat de sluis nu aan twee kanten onder politieke controle. Washington bepaalt hoeveel H200's China mag kopen, Peking bepaalt hoeveel er binnenkomen en waar ze mogen draaien. Diezelfde tweerichtingsbeweging zag je in juli, toen Peking exportcontroles op zijn eigen AI-modellen en chiptechnologie verkende. Voor wie inferentie inkoopt betekent dat iets nuchters: de prijs van rekenkracht wordt niet meer alleen door vraag en aanbod gezet, maar door twee regeringen die aan dezelfde kraan draaien. Een meerjarenbudget dat op één prijslijn rust, leunt op een aanname die in Peking of Washington binnen een week kan kantelen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI die niet vastzit

Wat je AI kost, hangt af van chips en aanbieders waar je zelf geen knop voor hebt. Ik denk met je mee over die keuze, ontwerp de opzet en bouw hem ook, zodat je van model of leverancier kunt wisselen zonder alles opnieuw op te tuigen, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Nvidia ontkent plan voor China-specifieke inferentiechip
Nieuws
4

21 aug 04:20

Nvidia ontkent plan voor China-specifieke inferentiechip

Nvidia noemt het bericht dat het eind 2026 een China-specifieke inferentiechip levert onjuist, terwijl The Information zich op twee medewerkers beroept. De uitkomst bepaalt wie aanspraak maakt op schaarse inferentiecapaciteit.

Gesanctioneerd Inspur blijft Nvidia-topchips krijgen via Amerikaanse dochter
Nieuws
4

6 sep 12:07

Gesanctioneerd Inspur blijft Nvidia-topchips krijgen via Amerikaanse dochter

Inspur staat sinds maart 2023 op de Amerikaanse Entity List en bleef via zijn Amerikaanse dochter Aivres Nvidia-topchips ontvangen. De regel die dat gat moest dichten ligt stil tot 10 november 2026.

China overweegt exportcontroles op AI-modellen en chips
Nieuws
3 min

21 jul 10:25

China overweegt exportcontroles op AI-modellen en chips

China overweegt strengere exportcontroles op zowel zijn AI-modellen als zijn chips, meldt de Financial Times. Een verharding voorbij de eerdere toegangsbeperking, die bedrijven raakt die op goedkope Chinese open modellen zijn gaan bouwen.

Moonshot dient vertrouwelijk beursaanvraag in Hongkong in voor 3 miljard dollar
Nieuws
4 min

3 sep 14:24

Moonshot dient vertrouwelijk beursaanvraag in Hongkong in voor 3 miljard dollar

Moonshot heeft volgens drie ingewijden bij Reuters vertrouwelijk een beursaanvraag in Hongkong ingediend voor 3 miljard dollar. Voor de aanvraag brak het lab zijn buitenlandse structuur af en vestigde het zich in China.

Taiwan klaagt negen mensen aan om smokkel van 74 Nvidia-AI-servers naar China
Nieuws
5 min

24 aug 10:19

Taiwan klaagt negen mensen aan om smokkel van 74 Nvidia-AI-servers naar China

Het OM in Keelung klaagt negen mensen aan, onder wie medewerkers van Nvidia en Super Micro, voor het smokkelen van 74 AI-servers naar China. De goedkeuringsprocedure van de fabrikant werd van binnenuit opengebroken.

FCC werkt aan importverbod op nieuwe Chinese optische transceivers
Nieuws
4 min

4 aug 22:10

FCC werkt aan importverbod op nieuwe Chinese optische transceivers

De Amerikaanse FCC werkt aan een importverbod op nieuwe modellen Chinese optische transceivers, de modules die data binnen datacenters over glasvezel verplaatsen. Reuters meldt het op basis van vier ingewijden. Er ligt nog geen besluit.