Gang tussen rijen serverracks in een datacenter
Nieuws27 juni · 00:365 min leestijd

AWS verhoogt prijs Nvidia GPU-rekenkracht met 20 procent vanaf 1 juli

Amazon trekt de tarieven van zijn gereserveerde GPU-blokken voor machine learning met ongeveer 20 procent omhoog. Voor elke Nederlandse organisatie die AI draait op AWS is dat een directe kostenpost vanaf 1 juli.

Wie in Nederland AI traint of laat draaien op gehuurde Nvidia-GPU's bij Amazon, betaalt vanaf 1 juli simpelweg meer. AWS verhoogt de prijs van zijn EC2 Capacity Blocks for ML, de vooraf gereserveerde GPU-blokken waarmee bedrijven hun trainings- en inferentiewerk draaien, met ongeveer 20 procent. Dit is geen abstracte beursbeweging maar een rekening die direct hoger uitvalt voor iedereen die compute afneemt voor AI-werk.

Het is een opvallende zet in een markt waar cloudaanbieders elkaar normaal gesproken juist onderbieden. Dat AWS de prijs durft te verhogen, zegt evenveel over de schaarste aan GPU-capaciteit als over de rekening die jij straks krijgt.

Wat er precies verandert

De verhoging raakt EC2 Capacity Blocks for ML: het product waarmee je een blok Nvidia-GPU-capaciteit voor een vaste periode reserveert, van een paar uur tot enkele weken, speciaal voor machine learning. Techmedium The Information meldde als eerste dat de tarieven per 1 juli met ongeveer 20 procent omhoog gaan. AWS zelf houdt het kort: de prijzen worden "periodiek aangepast op basis van vraag en aanbod".

De nieuwe uurtarieven liggen volgens de cijfers die Investing.com publiceerde flink hoger dan veel teams gewend zijn. Een blok op de nieuwste Blackwell-generatie kost al snel meer dan twaalf tot veertien dollar per uur per instance, terwijl de inmiddels alomtegenwoordige Hopper-H100's rond de vijf dollar per uur uitkomen. Per losse instance lijkt dat behapbaar, maar een trainingsrun draait zelden op één kaart en zelden een uur.

Nieuwe AWS EC2 Capacity Blocks-uurtarieven per GPU-instance vanaf 1 juli 2026, in dollar per uur (bron: Investing.com)

Het is bovendien niet de eerste verhoging, maar opnieuw een stap omhoog. De richting is duidelijk: gereserveerde GPU-capaciteit wordt structureel duurder, niet goedkoper.

Waarom AWS dit kan doen

Het simpele antwoord is schaarste. De vraag naar GPU-rekenkracht overtreft het aanbod, en dan verschuift de macht naar de leverancier. AWS draaide afgelopen kwartaal 28 procent meer omzet, tot 37,6 miljard dollar, en Amazon trekt dit jaar zo'n 200 miljard dollar uit voor AI-infrastructuur, met de verwachting eind 2027 een miljoen Nvidia-chips te hebben staan. Dat is geen bedrijf dat capaciteit moet weggeven om klanten binnen te halen.

De markt leest het dan ook als een teken van kracht: investeringsbank Wells Fargo handhaafde na de aankondiging een koopadvies met een koersdoel van 312 dollar en wees nadrukkelijk op de prijszettingsmacht van AWS. Een prijsverhoging die klanten slikken zonder weg te lopen, is precies wat analisten 'pricing power' noemen, en het is jouw budget dat het verschil betaalt.

Wat dit betekent voor jouw bedrijf

Reken je AI-budget opnieuw door. Twintig procent erbovenop je grootste variabele kostenpost tikt hard aan zodra je verder bent dan een proefopstelling. En de prijs van het model zelf is daarbij niet eens de kern van het verhaal: of zelf draaien of inhuren goedkoper is, hangt vooral af van hoe goed je de dure machine eronder benut. Ik heb eerder uitgerekend dat het omslagpunt tussen open-weight modellen zelf hosten en een cloud-API afnemen pas rond 15 tot 20 miljoen tokens per dag ligt, een volume dat de meeste bedrijven niet halen. Een hogere GPU-prijs bij AWS schuift dat rekensommetje mee.

De bredere les is er een van afhankelijkheid. Wanneer één leverancier eenzijdig je rekening met een vijfde kan verhogen, zit je vast aan zijn voorwaarden, en dat is geen technisch detail maar een bedrijfsrisico dat op dezelfde plank hoort als één te grote klant of één onmisbare leverancier. De uitweg is meer keuze: Amazon probeert met zijn eigen Trainium-chips de Nvidia-rekening te drukken en biedt die chips nu ook buiten AWS aan om de prijzen op te breken, Google heeft zijn TPU's, en open modellen op Europese infrastructuur worden een serieus alternatief.

De nuchtere conclusie: behandel GPU-capaciteit zoals je elke andere kritieke inkoop behandelt. Ken je werkelijke verbruik, plan je reserveringen vooruit, en zorg dat je niet aan één leverancier vastzit op het moment dat hij besluit de prijs te verhogen. Want dat moment kies je niet zelf.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-rekening

Een GPU-prijs die zomaar 20 procent stijgt laat zien hoe snel je vastzit aan één leverancier. Ik denk met je mee over je AI-architectuur en bouw oplossingen die je kosten en je afhankelijkheid in eigen hand houden, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt
Nieuws
4

20 jul 18:11

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt

Google werkt aan Frozen v2, een inference-chip die delen van Gemini in het silicium legt en per token zes tot tien keer zuiniger zou zijn dan zijn huidige AI-chips. Wat dat betekent voor wie AI op Google Cloud draait.

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer
Nieuws
4 min

20 jul 16:22

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem van 72 versnellers, en strikt Microsoft als afnemer voor Azure. Hoe groot die afname is, maakten beide bedrijven niet bekend.

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba
Nieuws
4 min

31 jul 16:38

Kimi K3 draait op 20.000 gehuurde Nvidia-chips van Alibaba

Moonshot draait Kimi K3 op ongeveer 20.000 Nvidia-chips die het huurt via Alibaba, meldt Bloomberg. De rekenkracht achter het goedkope open model is geleend, bij een partij die tegelijk aandeelhouder en concurrent is.

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie
Nieuws
5 min

2 jul 20:26

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie

Claude-maker Anthropic zet volgens The Information eerste stappen naar een eigen AI-chip en sprak met Samsung als mogelijke producent. Bevestigd is er niets, maar de zet raakt de compute-kosten en het leveranciersrisico achter Claude.

Amazon wil Trainium-chips buiten AWS verkopen en daagt Nvidia direct uit
Nieuws
5 min

19 jun 02:15

Amazon wil Trainium-chips buiten AWS verkopen en daagt Nvidia direct uit

Amazon onderzoekt of het zijn zelfontworpen Trainium-AI-chips rechtstreeks aan andere datacenters verkoopt, niet langer alleen via AWS. Een directe aanval op de bijna-monopolie van Nvidia, met gevolgen voor je compute-kosten en je keuzevrijheid.

Nscale koopt Anyscale en levert straks ook de software boven zijn GPU's
Nieuws
4 min

30 jul 18:43

Nscale koopt Anyscale en levert straks ook de software boven zijn GPU's

Nscale neemt Anyscale over, het bedrijf achter Ray, en levert straks ook de software die AI-werk over GPU's verdeelt. Wat dat betekent voor wie rekenkracht bij een neocloud inkoopt.