Close-up van koelventilatoren op servers in een datacenter
Nieuws17 september · 22:344 min leestijd

Nebius verhoogt Nvidia-GPU-prijzen met 17 tot 21 procent

Nebius verhoogt per 1 oktober de on-demandprijzen voor Nvidia H100, H200, B200 en B300 met 17 tot 21 procent. Ook AMD EPYC Genoa en geheugen worden duurder, waardoor Nederlandse AI-budgetten opnieuw onder druk komen.

Nebius verhoogt per 1 oktober de pay-as-you-go-tarieven voor vier Nvidia-GPU's met 17 tot 21 procent, meldt Finimize op basis van Reuters, terwijl de vraag naar AI-rekenkracht het aanbod blijft overtreffen.

Voor Nederlandse bedrijven die AI trainen of inferentie draaien op losse GPU-uren, stijgt daarmee een directe variabele kostenpost. De nieuwe tarieven raken vooral teams die pieken opvangen met on-demand capaciteit. Wie maanden vooruit reserveert, krijgt een andere rekensom, maar legt zich ook langer vast op volume en leverancier.

De tarieven vanaf 1 oktober

Nebius vermeldt momenteel $3,85 voor H100, $4,50 voor H200, $7,15 voor B200 en $7,85 voor B300 per on-demand GPU-uur, exclusief btw. Nebius rekent de GPU's per seconde af, maar toont de prijzen per uur. De mededeling gaat over losse pay-as-you-go-capaciteit; de publieke prijskaart onderscheidt die van preemptible tarieven. De door Yahoo Finance beschreven klantmelding zet de tarieven per 1 oktober op de volgende niveaus:

RekenkrachtHuidig tariefVanaf 1 oktoberStijging
Nvidia H100$3,85 per GPU-uur$4,5016,9%
Nvidia H200$4,50 per GPU-uur$5,4020,0%
Nvidia B200$7,15 per GPU-uur$8,5018,9%
Nvidia B300$7,85 per GPU-uur$9,5021,0%
AMD EPYC Genoa CPU$0,012 per vCPU-uur$0,01525,0%
AMD EPYC Genoa-geheugen$0,0032 per GiB-uur$0,0045ongeveer 41%

De publieke berichtgeving noemt daarnaast verhogingen bij sommige Intel-CPU-instances en geheugenaanbiedingen, maar geeft voor Intel geen afzonderlijke nieuwe CPU-prijs. De exacte verhoging voor AMD EPYC Genoa is wel duidelijk: 0,003 dollar per vCPU-uur erbij.

Wat dit verandert voor AI-budgetten

Een organisatie die maandelijks 1.000 uur dezelfde H100-capaciteit gebruikt, betaalt vanaf oktober bij gelijkblijvend verbruik ongeveer 650 dollar per maand extra, vóór btw. Bij B300 komt daar voor hetzelfde aantal uren 1.650 dollar bij. Zulke bedragen zitten niet in de modellicentie, maar wel rechtstreeks in de rekening voor training, fine-tuning en inferentie.

Ook de CPU-laag telt mee. AI-omgevingen gebruiken CPU-uren en geheugen voor dataverwerking, orkestratie en opslag rond de GPU's. Een hogere GPU-prijs valt daardoor samen met duurdere ondersteunende capaciteit, ook als het aantal draaiende modellen niet verandert.

Flexibiliteit wordt een contractkeuze

Nebius maakt de keuze tussen losse uren en reserveren explicieter. Het bedrijf vermeldt dat klanten tot 35 procent onder het on-demandtarief kunnen uitkomen door grote GPU-clusters meerdere maanden vast te leggen. Dat voordeel ruilt flexibiliteit in voor voorspelbare afname: een team dat minder gebruikt, draagt wel het gereserveerde volume.

Finimize noemt dit de tweede prijsverhoging van Nebius in drie maanden. Ook concurrent CoreWeave tekent contracten tegen hogere prijzen, wat erop wijst dat de druk niet bij één aanbieder blijft. De markt beweegt daarmee van een simpele uurtarievenvergelijking naar een afweging tussen prijs, beschikbaarheid, looptijd en overstapruimte.

Van prijs per megawatt naar prijs per uur

De nieuwe tariefkaart maakt op klantniveau zichtbaar wat al eerder in de infrastructuurmarkt opviel. Nebius sloot contracten tegen meer dan 20 miljoen dollar per megawatt per jaar, terwijl kortlopende capaciteit volgens het bedrijf richting 40 tot 50 miljoen dollar per megawatt ging. De schaarsteprijs verschijnt nu ook op het niveau waarop Nederlandse teams hun cloudrekening voelen.

AI-rekenkracht wordt zo een inkooplaag naast de modelkeuze. On-demand blijft de snelste route voor wisselende experimenten, terwijl vaste capaciteit aantrekkelijker wordt zodra gebruik en planning voorspelbaar zijn. De kernverschuiving is dat toegang tot Nvidia-compute niet alleen afhangt van wat een GPU kan, maar ook van wanneer en onder welke voorwaarden een bedrijf die capaciteit kan vastleggen.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Maak AI-kosten voorspelbaar

Ik help je AI-toepassingen ontwerpen en realiseren met een passende cloud- of self-hosted strategie. Van meedenken en ontwerp tot bouwen, koppelen en automatiseren, zodat je niet blind op één leverancier hoeft te leunen.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

CoreWeave verhoogt prijzen met 25 procent en is op korte termijn uitverkocht
Nieuws
5 min

13 aug 00:10

CoreWeave verhoogt prijzen met 25 procent en is op korte termijn uitverkocht

CoreWeave verhoogde in juli alle SKU-prijzen met ongeveer 25 procent en meldt dat de capaciteit voor de korte termijn uitverkocht is. Ook oudere GPU-generaties worden niet goedkoper meer.

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information
Nieuws
5 min

27 aug 04:09

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information

The Information meldt een akkoord van 12,9 miljard dollar, Business Insider spreekt nog van lopende gesprekken. Geen van beide bedrijven bevestigt iets. Voor teams die modellen en inferentie van de hub halen, telt de neutraliteit.

Het onderpand van de AI-bouw is niet de chip, maar het contract
Signaal
7 min

26 aug 21:46

Het onderpand van de AI-bouw is niet de chip, maar het contract

Banken en verzekeraars financieren AI-rekenkracht niet meer op de chip, maar op het langlopende afnamecontract eronder. Dat verandert wat er in een inkoopgesprek over capaciteit werkelijk op tafel ligt.

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters
Nieuws
4 min

12 aug 02:22

Nvidia werkt aan open Nemotron 4 met minstens een biljoen parameters

Nvidia werkt volgens The Information aan Nemotron 4, een open model van minstens een biljoen parameters. Er is geen releasedatum en Nvidia bevestigt de details niet, maar de hardwaredrempel om zelf te draaien groeit wel mee.

Huawei plant Ascend 960DT en 960PR voor 2027
Nieuws
3 min

17 sep 08:41

Huawei plant Ascend 960DT en 960PR voor 2027

Huawei brengt de 960DT in Q1 2027 en de 960PR in Q3, eerder dan gepland. De roadmap maakt alternatieve AI-hardware concreter en legt voor Nederlandse organisaties de nadruk op software die tussen infrastructuren kan bewegen.

Nvidia H100-huurprijs stijgt 22 procent in een maand
Nieuws
3 min

8 sep 11:31

Nvidia H100-huurprijs stijgt 22 procent in een maand

De Nvidia H100 is bijna vier jaar oud, maar de huurprijs stijgt. Ornn ziet in zijn marktindex een maandgroei van ongeveer 19 tot 22 procent. Daardoor levert terugvallen naar oudere GPU's niet vanzelf een lagere AI-rekening op.