Serverkasten met GPU-hardware en bekabeling in een datacenter.
Nieuws30 september · 18:171 min leestijd

CoreWeave stelt NVIDIA Vera Rubin NVL72 beperkt beschikbaar

CoreWeave stelt NVIDIA Vera Rubin NVL72 beperkt beschikbaar. Cognition meldt tot 4,8 keer meer tokendoorvoer dan met GB200 bij een test voor zijn programmeeragent. De aankondiging noemt geen algemene snelheidsgarantie; de cloudcapaciteit blijft voorlopig beperkt.

NVIDIA Vera Rubin NVL72 komt op 30 september beperkt beschikbaar op CoreWeave Cloud; Cognition meldt volgens CoreWeave tot 4,8× meer tokendoorvoer dan met GB200 NVL72 voor de SWE-2-inferentie van Devin.

Voor Nederlandse organisaties met zware AI-agenttaken of versterkingsleren komt er een extra cloudroute bij. De Rubin-capaciteit blijft voorlopig beperkt beschikbaar, dus toegang tot voldoende rekenkracht telt mee in de cloudkeuze.

Een rack, twee workloads

Volgens NVIDIA bestaat een Vera Rubin NVL72-rack uit 72 Rubin-GPU's en 36 Vera-CPU's. CoreWeave noemt Cognition, maker van programmeeragent Devin, als eerste klant die productie-AI-agenten op deze capaciteit draait.

De 4,8×-claim vergelijkt Cognitions SWE-2-inferentie met GB200 NVL72. De grafiek toont de relatieve tokendoorvoer per GPU bij verschillende interactiviteitsniveaus. Het gemarkeerde punt van 4,8× geldt bij gelijke interactiviteit.

CoreWeave-grafiek vergelijkt de relatieve tokendoorvoer per GPU voor SWE-2-inferentie met GB200 NVL72 en markeert 4,8× bij gelijke interactiviteit. Bron: CoreWeave
CoreWeave-grafiek vergelijkt de relatieve tokendoorvoer per GPU voor SWE-2-inferentie met GB200 NVL72 en markeert 4,8× bij gelijke interactiviteit. Bron: CoreWeave

Voor versterkingsleren noemt CoreWeave 3,8× meer uitvoertokendoorvoer per GPU dan op GB200 NVL72, eveneens bij gelijke interactiviteit.

CoreWeave-grafiek markeert 3,8× meer uitvoertokendoorvoer per GPU voor versterkingsleren bij gelijke interactiviteit. Bron: CoreWeave
CoreWeave-grafiek markeert 3,8× meer uitvoertokendoorvoer per GPU voor versterkingsleren bij gelijke interactiviteit. Bron: CoreWeave

De aankondiging noemt geen modelversie, absolute tokens per seconde of prijs per token. De cijfers beschrijven dus de geteste workloads en voorspellen niet rechtstreeks de snelheid of kosten voor andere modellen.

CoreWeave verhoogde in augustus de prijzen met 25 procent toen korte-termijncapaciteit uitverkocht was. Voor Nederlandse teams met zware agenttaken telt de gemeten doorvoer daarom samen met de vraag of die capaciteit werkelijk beschikbaar is.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Je AI-agentworkload ontwerpen

Ik denk mee over de AI-workload, ontwerp de oplossing en realiseer en automatiseer het hele traject, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Het onderpand van de AI-bouw is niet de chip, maar het contract
Signaal
7 min

26 aug 21:46

Het onderpand van de AI-bouw is niet de chip, maar het contract

Banken en verzekeraars financieren AI-rekenkracht niet meer op de chip, maar op het langlopende afnamecontract eronder. Dat verandert wat er in een inkoopgesprek over capaciteit werkelijk op tafel ligt.

CoreWeave verdubbelt omzet naar 2,58 miljard dollar, schuld staat op 35 miljard
Nieuws
5

12 aug 00:09

CoreWeave verdubbelt omzet naar 2,58 miljard dollar, schuld staat op 35 miljard

CoreWeave verdubbelde zijn kwartaalomzet naar 2,58 miljard dollar, maar draagt 35 miljard dollar schuld en gaf in datzelfde kwartaal 6,4 miljard uit aan apparatuur. Wie rekenkracht inkoopt bij een neocloud, koopt die rekensom mee.

Nvidia geeft Sutskevers AI-lab toegang tot Vera Rubin en investeert mee
Nieuws
4 min

27 jul 18:24

Nvidia geeft Sutskevers AI-lab toegang tot Vera Rubin en investeert mee

Nvidia investeert in Safe Superintelligence en geeft het lab van Ilya Sutskever toegang tot het Vera Rubin-platform, goed voor een orde van grootte meer rekenkracht. Een lab zonder product springt daarmee vooraan in de rij voor schaarse AI-capaciteit.

Japan en Nvidia bouwen 's werelds eerste nationale AI-fabriek
Nieuws
5 min

17 jul 02:26

Japan en Nvidia bouwen 's werelds eerste nationale AI-fabriek

Japan verklaart als eerste land een AI-rekencluster tot nationale infrastructuur: een fabriek van 27.500 Nvidia-GPU's, 140 megawatt en tot 6,2 miljard dollar overheidsgeld. Soevereine rekenkracht, gebouwd op Amerikaans silicium.

NVIDIA lanceert platform voor agentbeveiliging
Nieuws
2 minBijgewerkt om 07:00

28 sep 12:38

NVIDIA lanceert platform voor agentbeveiliging

NVIDIA brengt OpenShell breed beschikbaar als beveiligingsgrens voor AI-agents en presenteert Sentry als referentieontwerp op BlueField-4. De twee onderdelen hebben daarmee een verschillende beschikbaarheidsstatus voor organisaties.

Nebius verhoogt Nvidia-GPU-prijzen met 17 tot 21 procent
Nieuws
4 min

17 sep 22:34

Nebius verhoogt Nvidia-GPU-prijzen met 17 tot 21 procent

Nebius verhoogt per 1 oktober de on-demandprijzen voor Nvidia H100, H200, B200 en B300 met 17 tot 21 procent. Ook AMD EPYC Genoa en geheugen worden duurder, waardoor Nederlandse AI-budgetten opnieuw onder druk komen.