Apple verkent een enterprise-server voor AI-inferentie met twee of vier toekomstige M8 Ultra-chips en mogelijke Nvidia-NVLink Fusion, niet vóór 2029, meldt The Information.
Voor Nederlandse organisaties zou dit een extra lokale route naast cloudcapaciteit betekenen: AI-modellen draaien op hardware in het eigen datacenter, met eigen beheer van data en rekenwerk. Vandaag verandert er niets, want Apple heeft het product niet aangekondigd en 2029 is alleen een gemeld doel.
Twee servervarianten blijven een plan
Volgens de berichtgeving richt Apple het systeem op AI-ontwikkelaars, bedrijven en overheidsorganisaties. De server is bedoeld voor inferentie, het uitvoeren van al getrainde modellen, niet voor het trainen ervan. De twee varianten zouden respectievelijk twee of vier M8 Ultra-chips krijgen. De M8 zelf is nog niet aangekondigd; geheugen, stroomverbruik, prijs, prestaties en leverdatum zijn onbekend.
De Decoder beschrijft het gemelde project als een inferentieserver met twee of vier M8 Ultra-chips, met levering niet vóór 2029, op basis van mensen die met het project bekend zijn. Dat maakt de richting concreet, maar nog geen product.
Apple heeft al een lokale basis
De mogelijke server zou voortbouwen op een route die Apple al op desktops laat zien. Apple’s huidige lokale AI-opzet met M5 Ultra, maximaal 512 GB geheugen en clusters van vier Mac Studio’s laat zien welke stap het bedrijf al heeft gezet buiten de cloud. Apple noemt daarbij 1,2 TB/s geheugenbandbreedte en tot drie keer snellere verspreide AI-inferentie met vier systemen.

Een Mac Studio-cluster is nog iets anders dan een server die Apple aan organisaties verkoopt. Bij zo’n product horen ook rackbeheer, monitoring, beveiligingsupdates, vervanging bij hardwarestoringen en ondersteuning voor de software die modellen uitvoert. Geen van die onderdelen is voor het gemelde M8-plan bekend.
NVLink is de mogelijke brug
Nvidia positioneert NVLink Fusion als een verbinding met hoge bandbreedte en lage vertraging waarmee eigen CPU’s en AI-versnellers (XPU’s) in Nvidia’s rackarchitectuur kunnen worden opgenomen. Het platform gaat daardoor verder dan een kabel tussen twee chips: Nvidia koppelt de techniek aan rackontwerp, netwerken, koeling, stroomvoorziening en beheer.
Voor Apple zou dat een duidelijke taakverdeling opleveren: eigen rekenchips aan de voorkant, een bestaande datacenterlaag van Nvidia eromheen. Dat is technisch voorstelbaar, maar Nvidia’s algemene productbeschrijving bevestigt geen Apple-configuratie. Er is ook geen publiek akkoord. Apple en Nvidia hebben de server of een overeenkomst niet publiek bevestigd, en het plan kan nog worden geschrapt of zonder Nvidia-techniek doorgaan, meldt XenoSpectrum.
Geen aankoopbeslissing voor vandaag
Voor een Nederlands bedrijf verandert de keuze vandaag dus niet. Er is geen M8-server om te bestellen, geen prijs om mee te rekenen en geen prestatiecijfer om naast een cloud-API te leggen. De mogelijke waarde zit later in een extra plaatsingskeuze voor workloads waarbij databeheer, voorspelbare vertraging of lokale controle zwaarder wegen dan de flexibiliteit van de cloud.
Daar staat eigen verantwoordelijkheid tegenover: stroom, koeling, updates, storingen, modelbeheer en benutting komen dan binnen de organisatie te liggen. De vraag wordt daarmee niet alleen welke chip sneller is, maar ook wie de volledige AI-stack kan beheren. Als Apple deze stap zet, verschuift lokale AI van een krachtige desktopopstelling naar een mogelijke enterprise-infrastructuur. Dat is de ontwikkeling om te volgen, niet een server die er al staat.
Veelgestelde vragen
Lokale AI werkend krijgen
Ik help je bepalen welke AI-capaciteit je echt zelf wilt draaien, ontwerp de architectuur en bouw de software eromheen. Van meedenken en ontwerp tot realiseren en automatiseren, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
