AMD zet zijn AI-racksysteem Helios in volledige productie, maakte de chipmaker bekend op zijn Advancing AI-conferentie in San Francisco, en breidt tegelijk zijn hele chip- en netwerkportfolio uit om Nvidia breder aan te vallen.
Voor een Nederlands bedrijf dat AI-rekenkracht inkoopt, via Azure, OpenAI of een GPU-cloud, landt hiermee voor het eerst een serieus geprijsd alternatief voor Nvidia dat echt van de band rolt in plaats van als preview wordt aangekondigd. AMD claimt dat een Helios-rack tot 30 procent meer inference-tokens per dollar levert dan de concurrentie, en juist dat cijfer bepaalt hoeveel je AI-rekenwerk kost.
Wat er verandert sinds de preview
Drie dagen geleden was Helios nog een aankondiging met Microsoft als eerste Azure-afnemer. Het racksysteem bundelt 72 Instinct MI455X-versnellers met 31,1 terabyte HBM4-geheugen als een machine, goed voor 1,4 exaFLOPS aan FP8-rekenkracht. Nu heeft AMD het systeem formeel gelanceerd en in productie genomen, met een volledige generatie nieuwe chips eromheen.
Elk Helios-rack koppelt die 72 GPU's aan 18 zesde-generatie EPYC "Venice"-processors en Pensando-netwerkkaarten, aangestuurd door AMD's open ROCm-software in plaats van Nvidia's CUDA. Daarmee is het geen losse versneller meer maar een kant-en-klare AI-fabriek in een kast.
De cijfers die tellen
De sprong zit in de nieuwe Instinct MI400-serie. De MI455X levert volgens AMD 34 keer meer tokendoorvoer dan de vorige MI355X, en het instapmodel MI350P zou tot 4,2 keer meer tokens per seconde per dollar halen dan de concurrentie. Voor rekenwerk dat je per verwerkt token betaalt, is dat het getal dat je factuur bepaalt.
Die claims komen uit AMD's eigen conferentiemateriaal en wachten nog op onafhankelijke benchmarks. De richting is wel duidelijk: AMD verkoopt Helios niet op ruwe snelheid, maar op kosten per eenheid werk.
Wie het afneemt, en wanneer
De klantenlijst maakt het serieus. OpenAI brengt Helios vanaf het vierde kwartaal van 2026 online en versnelt de uitrol door 2027 heen. Anthropic, dat eerder deze week tot 5 miljard dollar aan AMD-investering en 2 gigawatt aan MI450-chips toezegde, draait die capaciteit nu op Helios. Daarnaast noemt AMD Meta, Microsoft, Oracle en cloudpartijen als Vultr, Tensorwave en Cirrascale.
Voor de meeste Nederlandse bedrijven komt Helios niet als losse aankoop binnen, maar als optie onder de motorkap van de clouds die ze al gebruiken. Precies zoals Microsoft de racks in Azure zet.
Meer dan een chip
AMD breidde op de conferentie ook uit naar de fabrieksvloer, met het Kria-platform en nieuwe Ryzen AI Embedded X100-processors voor robotica, plus een nieuwe ROCm.ai-ontwikkelomgeving. Topvrouw Lisa Su schetste de inzet groot: de markt voor AI-rekenkracht groeit volgens haar tegen 2030 richting 2 biljoen dollar, bijna de omvang van de hele halfgeleiderindustrie van nu.
De strijd verschuift van losse chips naar complete racks, en de timing valt in AMD's voordeel. Nvidia's eigen racksysteem Kyber schuift juist door naar 2028 vanwege een fabricageprobleem, terwijl de GPU-schaarste de prijzen blijft opdrijven. Zolang een tweede leverancier nu daadwerkelijk van de band rolt, verandert dat niet zozeer welke chip je koopt, maar hoeveel onderhandelingsmacht je hebt over de rekening.
Veelgestelde vragen
Kiezen zonder vast te zitten
De echte winst van een tweede leverancier is keuzevrijheid. Ik help je die inbouwen: van meedenken over je AI-architectuur tot bouwen, koppelen en automatiseren, self-hosted waar dat kan, zodat je niet aan een aanbieder vastzit.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
