Nebius verhoogt per 1 oktober de pay-as-you-go-tarieven voor vier Nvidia-GPU's met 17 tot 21 procent, meldt Finimize op basis van Reuters, terwijl de vraag naar AI-rekenkracht het aanbod blijft overtreffen.
Voor Nederlandse bedrijven die AI trainen of inferentie draaien op losse GPU-uren, stijgt daarmee een directe variabele kostenpost. De nieuwe tarieven raken vooral teams die pieken opvangen met on-demand capaciteit. Wie maanden vooruit reserveert, krijgt een andere rekensom, maar legt zich ook langer vast op volume en leverancier.
De tarieven vanaf 1 oktober
Nebius vermeldt momenteel $3,85 voor H100, $4,50 voor H200, $7,15 voor B200 en $7,85 voor B300 per on-demand GPU-uur, exclusief btw. Nebius rekent de GPU's per seconde af, maar toont de prijzen per uur. De mededeling gaat over losse pay-as-you-go-capaciteit; de publieke prijskaart onderscheidt die van preemptible tarieven. De door Yahoo Finance beschreven klantmelding zet de tarieven per 1 oktober op de volgende niveaus:
| Rekenkracht | Huidig tarief | Vanaf 1 oktober | Stijging |
|---|---|---|---|
| Nvidia H100 | $3,85 per GPU-uur | $4,50 | 16,9% |
| Nvidia H200 | $4,50 per GPU-uur | $5,40 | 20,0% |
| Nvidia B200 | $7,15 per GPU-uur | $8,50 | 18,9% |
| Nvidia B300 | $7,85 per GPU-uur | $9,50 | 21,0% |
| AMD EPYC Genoa CPU | $0,012 per vCPU-uur | $0,015 | 25,0% |
| AMD EPYC Genoa-geheugen | $0,0032 per GiB-uur | $0,0045 | ongeveer 41% |
De publieke berichtgeving noemt daarnaast verhogingen bij sommige Intel-CPU-instances en geheugenaanbiedingen, maar geeft voor Intel geen afzonderlijke nieuwe CPU-prijs. De exacte verhoging voor AMD EPYC Genoa is wel duidelijk: 0,003 dollar per vCPU-uur erbij.
Wat dit verandert voor AI-budgetten
Een organisatie die maandelijks 1.000 uur dezelfde H100-capaciteit gebruikt, betaalt vanaf oktober bij gelijkblijvend verbruik ongeveer 650 dollar per maand extra, vóór btw. Bij B300 komt daar voor hetzelfde aantal uren 1.650 dollar bij. Zulke bedragen zitten niet in de modellicentie, maar wel rechtstreeks in de rekening voor training, fine-tuning en inferentie.
Ook de CPU-laag telt mee. AI-omgevingen gebruiken CPU-uren en geheugen voor dataverwerking, orkestratie en opslag rond de GPU's. Een hogere GPU-prijs valt daardoor samen met duurdere ondersteunende capaciteit, ook als het aantal draaiende modellen niet verandert.
Flexibiliteit wordt een contractkeuze
Nebius maakt de keuze tussen losse uren en reserveren explicieter. Het bedrijf vermeldt dat klanten tot 35 procent onder het on-demandtarief kunnen uitkomen door grote GPU-clusters meerdere maanden vast te leggen. Dat voordeel ruilt flexibiliteit in voor voorspelbare afname: een team dat minder gebruikt, draagt wel het gereserveerde volume.
Finimize noemt dit de tweede prijsverhoging van Nebius in drie maanden. Ook concurrent CoreWeave tekent contracten tegen hogere prijzen, wat erop wijst dat de druk niet bij één aanbieder blijft. De markt beweegt daarmee van een simpele uurtarievenvergelijking naar een afweging tussen prijs, beschikbaarheid, looptijd en overstapruimte.
Van prijs per megawatt naar prijs per uur
De nieuwe tariefkaart maakt op klantniveau zichtbaar wat al eerder in de infrastructuurmarkt opviel. Nebius sloot contracten tegen meer dan 20 miljoen dollar per megawatt per jaar, terwijl kortlopende capaciteit volgens het bedrijf richting 40 tot 50 miljoen dollar per megawatt ging. De schaarsteprijs verschijnt nu ook op het niveau waarop Nederlandse teams hun cloudrekening voelen.
AI-rekenkracht wordt zo een inkooplaag naast de modelkeuze. On-demand blijft de snelste route voor wisselende experimenten, terwijl vaste capaciteit aantrekkelijker wordt zodra gebruik en planning voorspelbaar zijn. De kernverschuiving is dat toegang tot Nvidia-compute niet alleen afhangt van wat een GPU kan, maar ook van wanneer en onder welke voorwaarden een bedrijf die capaciteit kan vastleggen.
Veelgestelde vragen
Maak AI-kosten voorspelbaar
Ik help je AI-toepassingen ontwerpen en realiseren met een passende cloud- of self-hosted strategie. Van meedenken en ontwerp tot bouwen, koppelen en automatiseren, zodat je niet blind op één leverancier hoeft te leunen.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
