Rijen zwarte serverracks in een verlichte datacenterruimte
Nieuws6 juli · 10:093 min leestijd

Nvidia stelt AI-racksysteem Kyber uit tot 2028 door fabricageprobleem

Nvidia's volgende AI-racksysteem Kyber schuift ruim een jaar op naar 2028 door een printplaat die nauwelijks foutloos te maken is. Dat houdt de schaarse rekenkracht langer krap en duur.

Nvidia's Kyber NVL144, het racksysteem dat 144 van zijn krachtigste AI-chips in één kast bundelt, schuift ruim een jaar op naar 2028 door een printplaat die nauwelijks foutloos te maken is, meldt analistenbureau SemiAnalysis.

Voor elk bedrijf dat rekencapaciteit inkoopt bij een hyperscaler of GPU-cloud verschuift dat de rekensom. Kyber was de volgende grote sprong in dichtheid en efficiëntie per rack; met een jaar uitstel blijft de huidige generatie langer het plafond. De schaarste die de prijzen nu opdrijft, dooft daarmee niet snel: AWS verhoogde de prijs van Nvidia-GPU-rekenkracht per 1 juli met 20 procent vanwege aanhoudende chipschaarste, en een vertraagde capaciteitssprong houdt precies die druk op de markt.

Wat er precies misgaat

Het knelpunt zit in één component: de 'midplane', de printplaat die alle chips in een rack met elkaar verbindt. Die telt tot 78 lagen en combineert exotische materialen (koperlaminaat van M9-kwaliteit, kwartsweefsel en PTFE) met baanbreedtes van 25 micrometer of minder, nodig om de signalen op de vereiste 448G-snelheid betrouwbaar door te geven. SemiAnalysis noemt de plaat extreem foutgevoelig en kostbaar, en wereldwijd kunnen maar weinig fabrikanten hem in grote aantallen maken.

Wat sneuvelt in de roadmap

De vertraging haalt meer onderuit dan een lanceerdatum. De krachtigste variant van Rubin Ultra, met vier reken-chips per module, is geschrapt; wat overblijft is een versie met twee chips en ruwweg de helft van de beoogde prestaties. Ook het grotere NVL576-systeem, dat 576 GPU's over acht racks koppelt, staat op losse schroeven en gaat mogelijk pas later of in kleine oplages de deur uit. Een noodplan om twee bestaande racks aan elkaar te knopen sneuvelde eerder al: cloudklanten vonden dat ontwerp omslachtig en duur in onderhoud.

Wat blijft en waar het heen wijst

Wat wél op schema ligt, is de huidige Rubin-generatie: die gaat dit najaar naar acht cloudpartners, waaronder AWS, Microsoft Azure en Google Cloud. Voor de korte termijn verandert er dus weinig aan wat je kunt inkopen. De pijn zit in het jaar dat de volgende sprong nu uitblijft.

Nvidia leunt zwaar op één toeleveringsketen die tegen haar grenzen aan zit, en dat opent een deur voor de achtervolgers: SemiAnalysis ziet AMD en Google een zeldzame kans krijgen om aan de top mee te doen. Voor wie AI-capaciteit voor 2027 en 2028 inplant, betekent het vooral dat de markt langer krap en duur blijft, en dat de keuze aan de top breder kan worden dan alleen Nvidia.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Slim omgaan met AI-capaciteit

Als je AI-plannen afhangen van dure, schaarse rekenkracht bij één cloud, denk ik met je mee over de hele route: van ontwerp en koppeling tot self-hosted draaien waar dat kan, zodat je niet vastzit aan één leverancier of één roadmap.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Nscale koopt Anyscale en levert straks ook de software boven zijn GPU's
Nieuws
4 min

30 jul 18:43

Nscale koopt Anyscale en levert straks ook de software boven zijn GPU's

Nscale neemt Anyscale over, het bedrijf achter Ray, en levert straks ook de software die AI-werk over GPU's verdeelt. Wat dat betekent voor wie rekenkracht bij een neocloud inkoopt.

Nvidia bezit 9,3 procent van AI-cloudbedrijf Nebius
Nieuws
4 min

21 jul 16:26

Nvidia bezit 9,3 procent van AI-cloudbedrijf Nebius

Nvidia bezit 9,3 procent van het Amsterdamse AI-cloudbedrijf Nebius, blijkt uit een Schedule 13G-melding bij de SEC. De chipleverancier is nu grootaandeelhouder van een platform waarop AI-bedrijven hun rekenkracht draaien.

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer
Nieuws
4 min

20 jul 16:22

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem van 72 versnellers, en strikt Microsoft als afnemer voor Azure. Hoe groot die afname is, maakten beide bedrijven niet bekend.

Amsterdams Nebius verkoopt voor ruim een miljard dollar rekenkracht aan Reflection AI
Nieuws
4 min

15 jul 08:19

Amsterdams Nebius verkoopt voor ruim een miljard dollar rekenkracht aan Reflection AI

Het Amsterdamse Nebius verkoopt voor ruim een miljard dollar aan AI-rekenkracht aan de Amerikaanse startup Reflection, tot 2029 en op Nvidia's GB300-chips. Het is Reflections tweede miljardencontract voor compute, en tekent hoe schaars GPU-capaciteit blijft.

Hugging Face verkent verkoop van minstens 13 miljard dollar
Nieuws
4 min

23 aug 22:21

Hugging Face verkent verkoop van minstens 13 miljard dollar

Business Insider meldt dat Hugging Face een verkoop verkent van minstens 13 miljard dollar. Het bedrijf bevestigt niets. Voor teams die modellen, datasets en inferentie van de hub halen, telt vooral de eigenaarsvraag.

Anthropic haalt TPU-grondlegger Amir Salek binnen voor eigen chips
Nieuws
3 min

22 aug 12:25

Anthropic haalt TPU-grondlegger Amir Salek binnen voor eigen chips

Anthropic haalt Amir Salek binnen, de man die Googles TPU-programma opzette en zeven chipgeneraties afleverde. Hij versterkt het compute-team dat eigen silicium onder Claude moet leggen. Aan de Claude-factuur verandert vandaag niets.