Close-up van een processorchip op een printplaat
Nieuws20 juli · 16:224 min leestijd

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem van 72 versnellers, en strikt Microsoft als afnemer voor Azure. Hoe groot die afname is, maakten beide bedrijven niet bekend.

Update · 20 juli · 20:15

Gelekt GitHub-bestand van AMD-topman noemt Anthropic als prioriteitsklant

Op dezelfde dag als de Helios-deal met Microsoft dook een tweede AMD-signaal op: een YAML-bestand op GitHub van Anush Elangovan, vicepresident AI-software bij AMD, noemde Anthropic als 'klant' met de maximale prioriteit van 30 'priority boost points', gelijk aan grootafnemer Meta. Chip-analist SemiAnalysis meldde de vondst zondag; volgens die analyse zit Anthropic nog in de evaluatiefase van de AMD-hardware en werft het ROCm-ingenieurs om zijn rekenkracht verder te spreiden. Noch AMD noch Anthropic bevestigde een samenwerking; AMD zou die deze week op zijn Advancing AI-conferentie (22 en 23 juli) kunnen aankondigen als de openstaande zorgen over softwarekwaliteit zijn opgelost. Anthropic draait Claude nu op een mix van Nvidia-GPU's, Amazons Trainium en Googles TPU's, met Amazon als hoofdpartner. Voor wie op Claude bouwt is de inzet concreet: komt de maker van Claude ook bij AMD terecht, dan groeit de druk op Nvidia's prijsmacht die de rekenkosten hoog houdt, precies de verschuiving die de Helios-deal met Microsoft al liet zien.

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem dat 72 versnellers als één machine bundelt, met Microsoft als nieuwe grote afnemer voor Azure. Dat kondigde de chipmaker aan op zijn Advancing AI-evenement; Microsoft neemt Helios in Azure af naast eerdere AMD-klanten OpenAI en Meta.

Voor wie AI-workloads op Azure draait, verandert er op papier iets fundamenteels: er komt voor het eerst een compleet alternatief voor Nvidia binnen dezelfde cloud. Meer concurrentie op systeemniveau is precies wat op termijn de schaarste en de prijzen kan drukken die cloud-GPU's het afgelopen jaar duurder maakten. Tegelijk is nuchterheid op zijn plaats. AMD en Microsoft noemden niet hoe groot Microsofts afname is, in euro's noch in wattage, en een prijswijziging voor Azure AI-diensten is er niet aangekondigd. De winst is voorlopig structureel, niet je maandrekening: er staat nu een tweede geloofwaardige systeemleverancier.

Officiële aankondigingsbanner van AMD en Microsoft met beide bedrijfslogo's tegen een blauwe golfachtergrond. Bron AMD
Officiële aankondigingsbanner van AMD en Microsoft met beide bedrijfslogo's tegen een blauwe golfachtergrond. Bron AMD

Helios: 72 versnellers als één rack

Helios is AMD's antwoord op de verschuiving van losse chips naar complete racks. Het systeem bundelt 72 Instinct MI455X-versnellers met samen 31,1 terabyte HBM4-geheugen, goed voor 1,4 exaFLOPS aan FP8-rekenkracht en 2,9 exaFLOPS FP4. De interne bandbreedte van 260 TB/s ligt op gelijke hoogte met Nvidia's Vera Rubin NVL72, het systeem waar Helios het later dit jaar tegen opneemt. De bandbreedte tussen racks van 43 TB/s ligt op papier zelfs rond het dubbele, al moet die aanpak met UALink over Ethernet zich in de praktijk nog bewijzen.

Meer dan een chip

AMD verkoopt met Helios geen los onderdeel maar een geïntegreerd platform: de MI455X-versnellers, de volgende generatie EPYC-processors met codenaam Venice, Pensando-netwerktechniek en de ROCm-software eromheen. Dat systeemargument is de kern van de pitch, want de echte drempel om van Nvidia weg te stappen zit niet in de chip maar in de CUDA-software eronder. Met een open ROCm-stack en keuze als verkoopargument mikt AMD precies op die softwaremuur.

Voor Azure-klanten wordt de AMD-rekenkracht beschikbaar voor zowel training als inference. Dezelfde infrastructuur gaat ook de beheerde compute onder Microsoft Foundry voeden, het platform waarmee bedrijven eigen AI-toepassingen bouwen. Zo krijgt een enkel bedrijf dat modellen draait er in de praktijk een tweede hardwarespoor bij, zonder van cloud te wisselen.

De strijd verschuift naar het rack

De aankondiging tekent de bredere verschuiving in de AI-hardwaremarkt: de concurrentie gaat niet langer om de snelste losse chip maar om wie het complete rack levert. Een tweede systeemleverancier binnen een hyperscaler holt een monopolie daadwerkelijk uit, meer dan een losse versneller dat doet. Dat komt bovenop een Nvidia die zijn eigen tempo niet altijd haalt: het volgende rack-systeem Kyber schoof onlangs door naar 2028, terwijl de chipschaarste de cloudprijzen hoog houdt. Waar dat op uitkomt voor de rekening van een Azure-klant hangt af van hoeveel Helios-capaciteit Microsoft echt uitrolt, en dat cijfer ligt er nog niet.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Grip op je AI-stack

De les van deze systeemstrijd is dat keuze en grip op je infrastructuur geld waard zijn. Ik denk met je mee, ontwerp en bouw je AI-oplossing van begin tot eind, self-hosted waar dat kan, zodat je niet vastzit aan één leverancier.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt
Nieuws
4

20 jul 18:11

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt

Google werkt aan Frozen v2, een inference-chip die delen van Gemini in het silicium legt en per token zes tot tien keer zuiniger zou zijn dan zijn huidige AI-chips. Wat dat betekent voor wie AI op Google Cloud draait.

Franse toezichthouder: drie bedrijven beheersen 84 procent van AI-agentenmarkt
Nieuws
4 min

18 jul 14:22

Franse toezichthouder: drie bedrijven beheersen 84 procent van AI-agentenmarkt

De Franse mededingingsautoriteit becijfert dat OpenAI, Google en Anthropic samen ruim 84 procent van de wereldwijde markt voor AI-agenten beheersen. Ze waarschuwt voor lock-in en beperkte overstapbaarheid, maar deelt geen boete uit.

Meta metselt zich in, en de open fakkel verhuist
Signaal
7 min

17 jul 16:01

Meta metselt zich in, en de open fakkel verhuist

Meta ruilde zijn open Llama in voor een gesloten Muse Spark en metselt er een eigen chip, cloud en app-laag omheen. Los is het bedrijfsnieuws, samen een beweging. En de open fakkel? Die verhuist gewoon.

Meta start in september productie van eigen AI-chip Iris
Nieuws
4 min

10 jul 02:24

Meta start in september productie van eigen AI-chip Iris

Meta begint in september met de productie van zijn eigen AI-chip Iris en wil zijn rekencapaciteit in 2027 verdubbelen naar 14 gigawatt. Een intern memo dat Reuters inzag legt de compute-strategie onder je cloudrekening bloot.

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie
Nieuws
5 min

2 jul 20:26

Anthropic verkent eigen AI-chip en klopt bij Samsung aan voor productie

Claude-maker Anthropic zet volgens The Information eerste stappen naar een eigen AI-chip en sprak met Samsung als mogelijke producent. Bevestigd is er niets, maar de zet raakt de compute-kosten en het leveranciersrisico achter Claude.

Anthropic & SpaceX: Een strategische compute-alliantie die de AI- en ruimtevaartindustrie hervormt
Nieuws
15 min

9 mei 01:21

Anthropic & SpaceX: Een strategische compute-alliantie die de AI- en ruimtevaartindustrie hervormt

Op 6 mei 2026 kondigden Anthropic en SpaceXAI (de fusie van SpaceX en xAI) een opmerkelijke strategische samenwerking aan die de krachten bundelt tussen twee van de machtigste spelers in de technologie-industrie [1][2]. Waar Elon Musk, eigenaar van SpaceXAI, Anthropic eerder nog bestempelde als...