Netwerk- en serverapparatuur in een datacenter met glasvezelkabels naar de racks.
Nieuws24 juli · 04:124 leestijd

AMD zet AI-racksysteem Helios in volledige productie

AMD zet zijn AI-racksysteem Helios in volledige productie en breidt zijn chip- en netwerkportfolio uit. Voor bedrijven die AI-rekenkracht inkopen landt zo het eerste serieus geprijsde alternatief voor Nvidia dat echt van de band rolt.

AMD zet zijn AI-racksysteem Helios in volledige productie, maakte de chipmaker bekend op zijn Advancing AI-conferentie in San Francisco, en breidt tegelijk zijn hele chip- en netwerkportfolio uit om Nvidia breder aan te vallen.

Voor een Nederlands bedrijf dat AI-rekenkracht inkoopt, via Azure, OpenAI of een GPU-cloud, landt hiermee voor het eerst een serieus geprijsd alternatief voor Nvidia dat echt van de band rolt in plaats van als preview wordt aangekondigd. AMD claimt dat een Helios-rack tot 30 procent meer inference-tokens per dollar levert dan de concurrentie, en juist dat cijfer bepaalt hoeveel je AI-rekenwerk kost.

Wat er verandert sinds de preview

Drie dagen geleden was Helios nog een aankondiging met Microsoft als eerste Azure-afnemer. Het racksysteem bundelt 72 Instinct MI455X-versnellers met 31,1 terabyte HBM4-geheugen als een machine, goed voor 1,4 exaFLOPS aan FP8-rekenkracht. Nu heeft AMD het systeem formeel gelanceerd en in productie genomen, met een volledige generatie nieuwe chips eromheen.

Elk Helios-rack koppelt die 72 GPU's aan 18 zesde-generatie EPYC "Venice"-processors en Pensando-netwerkkaarten, aangestuurd door AMD's open ROCm-software in plaats van Nvidia's CUDA. Daarmee is het geen losse versneller meer maar een kant-en-klare AI-fabriek in een kast.

De cijfers die tellen

De sprong zit in de nieuwe Instinct MI400-serie. De MI455X levert volgens AMD 34 keer meer tokendoorvoer dan de vorige MI355X, en het instapmodel MI350P zou tot 4,2 keer meer tokens per seconde per dollar halen dan de concurrentie. Voor rekenwerk dat je per verwerkt token betaalt, is dat het getal dat je factuur bepaalt.

Die claims komen uit AMD's eigen conferentiemateriaal en wachten nog op onafhankelijke benchmarks. De richting is wel duidelijk: AMD verkoopt Helios niet op ruwe snelheid, maar op kosten per eenheid werk.

Wie het afneemt, en wanneer

De klantenlijst maakt het serieus. OpenAI brengt Helios vanaf het vierde kwartaal van 2026 online en versnelt de uitrol door 2027 heen. Anthropic, dat eerder deze week tot 5 miljard dollar aan AMD-investering en 2 gigawatt aan MI450-chips toezegde, draait die capaciteit nu op Helios. Daarnaast noemt AMD Meta, Microsoft, Oracle en cloudpartijen als Vultr, Tensorwave en Cirrascale.

Voor de meeste Nederlandse bedrijven komt Helios niet als losse aankoop binnen, maar als optie onder de motorkap van de clouds die ze al gebruiken. Precies zoals Microsoft de racks in Azure zet.

Meer dan een chip

AMD breidde op de conferentie ook uit naar de fabrieksvloer, met het Kria-platform en nieuwe Ryzen AI Embedded X100-processors voor robotica, plus een nieuwe ROCm.ai-ontwikkelomgeving. Topvrouw Lisa Su schetste de inzet groot: de markt voor AI-rekenkracht groeit volgens haar tegen 2030 richting 2 biljoen dollar, bijna de omvang van de hele halfgeleiderindustrie van nu.

De strijd verschuift van losse chips naar complete racks, en de timing valt in AMD's voordeel. Nvidia's eigen racksysteem Kyber schuift juist door naar 2028 vanwege een fabricageprobleem, terwijl de GPU-schaarste de prijzen blijft opdrijven. Zolang een tweede leverancier nu daadwerkelijk van de band rolt, verandert dat niet zozeer welke chip je koopt, maar hoeveel onderhandelingsmacht je hebt over de rekening.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Kiezen zonder vast te zitten

De echte winst van een tweede leverancier is keuzevrijheid. Ik help je die inbouwen: van meedenken over je AI-architectuur tot bouwen, koppelen en automatiseren, self-hosted waar dat kan, zodat je niet aan een aanbieder vastzit.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Genoemde integraties

Dit artikel noemt deze tools. Ik koppel ze op maat aan je eigen systemen.

Gerelateerde artikelen

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer
Nieuws
4 minBijgewerkt om 20:15

20 jul 16:22

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem van 72 versnellers, en strikt Microsoft als afnemer voor Azure. Hoe groot die afname is, maakten beide bedrijven niet bekend.

AMD investeert tot 5 miljard dollar in Anthropic en levert 2 gigawatt aan AI-chips
Nieuws
4 min

22 jul 16:10

AMD investeert tot 5 miljard dollar in Anthropic en levert 2 gigawatt aan AI-chips

AMD investeert tot 5 miljard dollar in Anthropic en levert de Claude-maker tot 2 gigawatt aan Instinct MI450-chips vanaf 2027. Anthropic spreidt zijn rekenkracht daarmee verder buiten Nvidia, Amazon en Google.

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt
Nieuws
4

20 jul 18:11

Google bouwt inference-chip Frozen v2 die Gemini in silicium bakt

Google werkt aan Frozen v2, een inference-chip die delen van Gemini in het silicium legt en per token zes tot tien keer zuiniger zou zijn dan zijn huidige AI-chips. Wat dat betekent voor wie AI op Google Cloud draait.

Project Perception is goedkoper, maar wie ziet nu de kaart van je lekken?
Inzicht
6 min

22 jul 09:00

Project Perception is goedkoper, maar wie ziet nu de kaart van je lekken?

Microsoft brengt met Project Perception een goedkopere AI-bugfinder. Maar goedkoper betekent hier een modelrouter die je code langs drie leveranciers stuurt. Je verlaagt niet je risico, je verschuift wie de kaart van je zwakke plekken ziet.

Nvidia daagt AMD en Intel uit met server-CPU Vera
Nieuws
5 min

21 jul 20:20

Nvidia daagt AMD en Intel uit met server-CPU Vera

Nvidia bracht de volledige specificaties en de eerste SPEC CPU 2026-benchmarks van Vera naar buiten, zijn eigen 88-core server-CPU. De chip wint per core, maar blijft in totale doorvoer dicht bij AMD's EPYC en achter op de zwaarste modellen.

Microsoft test Kimi K3 om Copilot goedkoper te draaien
Nieuws
4 min

20 jul 22:12

Microsoft test Kimi K3 om Copilot goedkoper te draaien

Microsoft zet het Chinese open-weight model Kimi K3 op Azure en onderzoekt of het Copilot-functies kan overnemen die nu op OpenAI en Anthropic draaien. The Information becijfert de mogelijke besparing op tot 600 miljoen dollar.