Gelekt GitHub-bestand van AMD-topman noemt Anthropic als prioriteitsklant
Op dezelfde dag als de Helios-deal met Microsoft dook een tweede AMD-signaal op: een YAML-bestand op GitHub van Anush Elangovan, vicepresident AI-software bij AMD, noemde Anthropic als 'klant' met de maximale prioriteit van 30 'priority boost points', gelijk aan grootafnemer Meta. Chip-analist SemiAnalysis meldde de vondst zondag; volgens die analyse zit Anthropic nog in de evaluatiefase van de AMD-hardware en werft het ROCm-ingenieurs om zijn rekenkracht verder te spreiden. Noch AMD noch Anthropic bevestigde een samenwerking; AMD zou die deze week op zijn Advancing AI-conferentie (22 en 23 juli) kunnen aankondigen als de openstaande zorgen over softwarekwaliteit zijn opgelost. Anthropic draait Claude nu op een mix van Nvidia-GPU's, Amazons Trainium en Googles TPU's, met Amazon als hoofdpartner. Voor wie op Claude bouwt is de inzet concreet: komt de maker van Claude ook bij AMD terecht, dan groeit de druk op Nvidia's prijsmacht die de rekenkosten hoog houdt, precies de verschuiving die de Helios-deal met Microsoft al liet zien.
AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem dat 72 versnellers als één machine bundelt, met Microsoft als nieuwe grote afnemer voor Azure. Dat kondigde de chipmaker aan op zijn Advancing AI-evenement; Microsoft neemt Helios in Azure af naast eerdere AMD-klanten OpenAI en Meta.
Voor wie AI-workloads op Azure draait, verandert er op papier iets fundamenteels: er komt voor het eerst een compleet alternatief voor Nvidia binnen dezelfde cloud. Meer concurrentie op systeemniveau is precies wat op termijn de schaarste en de prijzen kan drukken die cloud-GPU's het afgelopen jaar duurder maakten. Tegelijk is nuchterheid op zijn plaats. AMD en Microsoft noemden niet hoe groot Microsofts afname is, in euro's noch in wattage, en een prijswijziging voor Azure AI-diensten is er niet aangekondigd. De winst is voorlopig structureel, niet je maandrekening: er staat nu een tweede geloofwaardige systeemleverancier.

Helios: 72 versnellers als één rack
Helios is AMD's antwoord op de verschuiving van losse chips naar complete racks. Het systeem bundelt 72 Instinct MI455X-versnellers met samen 31,1 terabyte HBM4-geheugen, goed voor 1,4 exaFLOPS aan FP8-rekenkracht en 2,9 exaFLOPS FP4. De interne bandbreedte van 260 TB/s ligt op gelijke hoogte met Nvidia's Vera Rubin NVL72, het systeem waar Helios het later dit jaar tegen opneemt. De bandbreedte tussen racks van 43 TB/s ligt op papier zelfs rond het dubbele, al moet die aanpak met UALink over Ethernet zich in de praktijk nog bewijzen.
Meer dan een chip
AMD verkoopt met Helios geen los onderdeel maar een geïntegreerd platform: de MI455X-versnellers, de volgende generatie EPYC-processors met codenaam Venice, Pensando-netwerktechniek en de ROCm-software eromheen. Dat systeemargument is de kern van de pitch, want de echte drempel om van Nvidia weg te stappen zit niet in de chip maar in de CUDA-software eronder. Met een open ROCm-stack en keuze als verkoopargument mikt AMD precies op die softwaremuur.
Voor Azure-klanten wordt de AMD-rekenkracht beschikbaar voor zowel training als inference. Dezelfde infrastructuur gaat ook de beheerde compute onder Microsoft Foundry voeden, het platform waarmee bedrijven eigen AI-toepassingen bouwen. Zo krijgt een enkel bedrijf dat modellen draait er in de praktijk een tweede hardwarespoor bij, zonder van cloud te wisselen.
De strijd verschuift naar het rack
De aankondiging tekent de bredere verschuiving in de AI-hardwaremarkt: de concurrentie gaat niet langer om de snelste losse chip maar om wie het complete rack levert. Een tweede systeemleverancier binnen een hyperscaler holt een monopolie daadwerkelijk uit, meer dan een losse versneller dat doet. Dat komt bovenop een Nvidia die zijn eigen tempo niet altijd haalt: het volgende rack-systeem Kyber schoof onlangs door naar 2028, terwijl de chipschaarste de cloudprijzen hoog houdt. Waar dat op uitkomt voor de rekening van een Azure-klant hangt af van hoeveel Helios-capaciteit Microsoft echt uitrolt, en dat cijfer ligt er nog niet.
Veelgestelde vragen
Grip op je AI-stack
De les van deze systeemstrijd is dat keuze en grip op je infrastructuur geld waard zijn. Ik denk met je mee, ontwerp en bouw je AI-oplossing van begin tot eind, self-hosted waar dat kan, zodat je niet vastzit aan één leverancier.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

