Peking laat kleine partijen Nvidia H200-chips het Chinese vasteland op, meldt de Financial Times: ByteDance en Tencent kregen elk ongeveer tienduizend exemplaren, terwijl Washington aankopen tot honderdduizend per bedrijf toestaat.
Twintigduizend chips stellen op wereldschaal weinig voor, maar de vergunningen eronder wel. Gaan de ongeveer tien Chinese bedrijven met een Amerikaanse licentie hun quotum echt opnemen, dan komt er een claim van honderdduizenden H200's bij op precies de productie waar Europese kopers ook in de rij staan. Dat raakt de aanname onder menig Nederlands AI-budget: dat rekenkracht per token vanzelf goedkoper wordt zodra de schaarste afneemt. Die aanname struikelde deze zomer al toen de prijs van gereserveerde Nvidia-GPU-blokken bij AWS per 1 juli met ongeveer 20 procent omhoog ging.
Wat Peking precies toelaat
Peking staat de zendingen toe om zijn belangrijkste techbedrijven te helpen de achterstand op Amerikaanse rivalen in te lopen, schrijft de Financial Times. ByteDance en Tencent ontvingen de afgelopen weken elk ongeveer tienduizend H200's, en andere Chinese techbedrijven kunnen binnenkort vergelijkbare leveringen krijgen. Persbureau Reuters, dat het bericht overnam, kon het niet zelfstandig bevestigen; Nvidia reageerde niet op vragen.
Tegelijk stuurt Peking het grootste deel van de hardware weg van het vasteland. Regelgevers lieten de bedrijven weten dat ze de chips naar Hongkong mogen brengen en daar mogen laten draaien, omdat Hongkong buiten de douanegrens van het vasteland valt. Chinese teams krijgen de rekenkracht zo wel, maar hij staat niet in een datacenter op het vasteland.
De rem zat in Peking, niet in Washington
De Amerikaanse vergunningen liggen er al maanden. Washington blokkeerde H200-export in 2025, kondigde in december van dat jaar een gedeeltelijke versoepeling aan in ruil voor een kwart van de verkoopopbrengst, en gaf in mei ongeveer tien Chinese bedrijven groen licht, waaronder Alibaba, Tencent, ByteDance en JD.com, met Lenovo en Foxconn als goedgekeurde distributeurs. Daarna gebeurde er weinig, omdat de Chinese kopers zich inhielden nadat Peking hen had aangespoord in de binnenlandse industrie te investeren.
Op 14 juli vertelde Jeffrey Kessler, de Amerikaanse onderminister van Handel voor industrie en veiligheid, aan de buitenlandcommissie van het Huis van Afgevaardigden dat de leveringen begonnen waren, maar dat er tot dan toe slechts een zeer beperkt aantal H200's naar China was gegaan. Wat er nu verandert zit dus aan de Chinese invoerkant, niet aan de Amerikaanse exportkant.
Waarom juist de H200 je inferentierekening raakt
De H200 is vooral een geheugenkaart. Nvidia geeft hem 141 GB HBM3e-geheugen en 4,8 terabyte per seconde aan bandbreedte, bijna het dubbele geheugen en 1,4 keer de bandbreedte van de H100, goed voor ongeveer 1,9 keer meer doorvoer op Llama 2 70B. Dat is precies het werk waar de tokenprijs op rust: een groot model dat antwoorden uitserveert aan veel gebruikers tegelijk. Elke H200 die naar een Chinees datacenter gaat, is een kaart die niet bij een Europese aanbieder in een inferentiecluster belandt.

Peking houdt de deur op een kier voor zijn eigen chipmakers
De Hongkong-route is geen technisch detail maar beleid. Peking wil de vraag op het vasteland bij de binnenlandse chipindustrie houden, en die industrie staat er inmiddels naar: Huawei's Ascend 950 benadert de prestaties van de H200, terwijl Nvidia's aandeel in de Chinese AI-chipmarkt dit jaar naar zo'n 8 procent zakt tegen ongeveer 40 procent in 2025. Een land dat zijn eigen alternatief bijna op niveau heeft, laat de Amerikaanse chip binnen als aanvulling, niet als vervanging.
Daarmee staat de sluis nu aan twee kanten onder politieke controle. Washington bepaalt hoeveel H200's China mag kopen, Peking bepaalt hoeveel er binnenkomen en waar ze mogen draaien. Diezelfde tweerichtingsbeweging zag je in juli, toen Peking exportcontroles op zijn eigen AI-modellen en chiptechnologie verkende. Voor wie inferentie inkoopt betekent dat iets nuchters: de prijs van rekenkracht wordt niet meer alleen door vraag en aanbod gezet, maar door twee regeringen die aan dezelfde kraan draaien. Een meerjarenbudget dat op één prijslijn rust, leunt op een aanname die in Peking of Washington binnen een week kan kantelen.
Veelgestelde vragen
AI die niet vastzit
Wat je AI kost, hangt af van chips en aanbieders waar je zelf geen knop voor hebt. Ik denk met je mee over die keuze, ontwerp de opzet en bouw hem ook, zodat je van model of leverancier kunt wisselen zonder alles opnieuw op te tuigen, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
