Technicus werkt aan bekabelde hardware in een laboratorium
Nieuws17 september · 06:294 min leestijd

Apple verkent enterprise-AI-server met M8 Ultra en NVLink

Apple verkent naar verluidt een enterprise-server met twee of vier M8 Ultra-chips en Nvidia’s NVLink Fusion. Het plan kan lokale AI-inferentie naast cloudcapaciteit zetten, maar blijft onbevestigd en staat volgens de berichtgeving niet vóór 2029 gepland.

Apple verkent een enterprise-server voor AI-inferentie met twee of vier toekomstige M8 Ultra-chips en mogelijke Nvidia-NVLink Fusion, niet vóór 2029, meldt The Information.

Voor Nederlandse organisaties zou dit een extra lokale route naast cloudcapaciteit betekenen: AI-modellen draaien op hardware in het eigen datacenter, met eigen beheer van data en rekenwerk. Vandaag verandert er niets, want Apple heeft het product niet aangekondigd en 2029 is alleen een gemeld doel.

Twee servervarianten blijven een plan

Volgens de berichtgeving richt Apple het systeem op AI-ontwikkelaars, bedrijven en overheidsorganisaties. De server is bedoeld voor inferentie, het uitvoeren van al getrainde modellen, niet voor het trainen ervan. De twee varianten zouden respectievelijk twee of vier M8 Ultra-chips krijgen. De M8 zelf is nog niet aangekondigd; geheugen, stroomverbruik, prijs, prestaties en leverdatum zijn onbekend.

De Decoder beschrijft het gemelde project als een inferentieserver met twee of vier M8 Ultra-chips, met levering niet vóór 2029, op basis van mensen die met het project bekend zijn. Dat maakt de richting concreet, maar nog geen product.

Apple heeft al een lokale basis

De mogelijke server zou voortbouwen op een route die Apple al op desktops laat zien. Apple’s huidige lokale AI-opzet met M5 Ultra, maximaal 512 GB geheugen en clusters van vier Mac Studio’s laat zien welke stap het bedrijf al heeft gezet buiten de cloud. Apple noemt daarbij 1,2 TB/s geheugenbandbreedte en tot drie keer snellere verspreide AI-inferentie met vier systemen.

Apple-afbeelding van de M5 Max- en M5 Ultra-chips, Bron: Apple
Apple-afbeelding van de M5 Max- en M5 Ultra-chips, Bron: Apple

Een Mac Studio-cluster is nog iets anders dan een server die Apple aan organisaties verkoopt. Bij zo’n product horen ook rackbeheer, monitoring, beveiligingsupdates, vervanging bij hardwarestoringen en ondersteuning voor de software die modellen uitvoert. Geen van die onderdelen is voor het gemelde M8-plan bekend.

NVLink is de mogelijke brug

Nvidia positioneert NVLink Fusion als een verbinding met hoge bandbreedte en lage vertraging waarmee eigen CPU’s en AI-versnellers (XPU’s) in Nvidia’s rackarchitectuur kunnen worden opgenomen. Het platform gaat daardoor verder dan een kabel tussen twee chips: Nvidia koppelt de techniek aan rackontwerp, netwerken, koeling, stroomvoorziening en beheer.

Voor Apple zou dat een duidelijke taakverdeling opleveren: eigen rekenchips aan de voorkant, een bestaande datacenterlaag van Nvidia eromheen. Dat is technisch voorstelbaar, maar Nvidia’s algemene productbeschrijving bevestigt geen Apple-configuratie. Er is ook geen publiek akkoord. Apple en Nvidia hebben de server of een overeenkomst niet publiek bevestigd, en het plan kan nog worden geschrapt of zonder Nvidia-techniek doorgaan, meldt XenoSpectrum.

Geen aankoopbeslissing voor vandaag

Voor een Nederlands bedrijf verandert de keuze vandaag dus niet. Er is geen M8-server om te bestellen, geen prijs om mee te rekenen en geen prestatiecijfer om naast een cloud-API te leggen. De mogelijke waarde zit later in een extra plaatsingskeuze voor workloads waarbij databeheer, voorspelbare vertraging of lokale controle zwaarder wegen dan de flexibiliteit van de cloud.

Daar staat eigen verantwoordelijkheid tegenover: stroom, koeling, updates, storingen, modelbeheer en benutting komen dan binnen de organisatie te liggen. De vraag wordt daarmee niet alleen welke chip sneller is, maar ook wie de volledige AI-stack kan beheren. Als Apple deze stap zet, verschuift lokale AI van een krachtige desktopopstelling naar een mogelijke enterprise-infrastructuur. Dat is de ontwikkeling om te volgen, niet een server die er al staat.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Lokale AI werkend krijgen

Ik help je bepalen welke AI-capaciteit je echt zelf wilt draaien, ontwerp de architectuur en bouw de software eromheen. Van meedenken en ontwerp tot realiseren en automatiseren, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Langdock verplaatst moedermaatschappij naar Duitse SE
Nieuws
4 min

17 sep 02:55

Langdock verplaatst moedermaatschappij naar Duitse SE

Langdock haalt zijn Amerikaanse moedermaatschappij uit de structuur en richt een Duitse SE op. De volgende stap is een eigen datacenter, maar de huidige AI-keten blijft deels afhankelijk van Amerikaanse cloud- en modelleveranciers.

Cohere versleutelt AI-inferentie in Model Vault
Nieuws
4 min

17 sep 02:31

Cohere versleutelt AI-inferentie in Model Vault

Cohere voegt confidential computing toe aan Model Vault. Prompts en antwoorden blijven tijdens inferentie versleuteld in hardware-TEE’s, terwijl klanten de draaiende code en beveiligingspolicy vóór verzending kunnen laten attesteren.

Axelera AI verscheept Europa voor enterprise-inferentie
Nieuws
4 min

15 sep 20:21

Axelera AI verscheept Europa voor enterprise-inferentie

De Eindhovense chipmaker Axelera AI verscheept Europa nu als AIPU en PCIe-kaarten voor lokale enterprise-inferentie. Dell XE5 en Supermicro 111AD zijn gevalideerde systemen, terwijl prestatieclaims nog vooral uit eigen tests komen.

Shanghai AI Lab publiceert open gewichten van Atria Dawn
Nieuws
4 min

15 sep 16:35

Shanghai AI Lab publiceert open gewichten van Atria Dawn

Shanghai AI Lab publiceert Atria Dawn Preview, een open-weight onderzoeksagent op een MoE-basis van 744 miljard parameters. De MIT-licentie opent self-hosting, maar 1,51 TB aan gewichten maakt infrastructuur onderdeel van de modelkeuze.

Huawei plant Ascend 960DT en 960PR voor 2027
Nieuws
3 min

17 sep 08:41

Huawei plant Ascend 960DT en 960PR voor 2027

Huawei brengt de 960DT in Q1 2027 en de 960PR in Q3, eerder dan gepland. De roadmap maakt alternatieve AI-hardware concreter en legt voor Nederlandse organisaties de nadruk op software die tussen infrastructuren kan bewegen.

NVIDIA start alliantie voor flexibele AI-datacenters
Nieuws
4 min

17 sep 02:43

NVIDIA start alliantie voor flexibele AI-datacenters

NVIDIA, Google en Emerald AI starten een alliantie die AI-datacenters flexibeler moet laten omgaan met het elektriciteitsnet. De concrete inzet raakt computeplanning, operationele data, stroomcontracten en snellere netaansluitingen.