Compacte computers uit NVIDIA’s productlijn voor lokale AI staan naast elkaar.
Nieuws2 oktober · 17:222 min leestijd

NVIDIA kondigt 64GB-uitvoering van DGX Spark aan

NVIDIA voegt een DGX Spark met 64 GB geheugen toe vanaf $4.999. De nieuwe uitvoering draait modellen lokaal, maar NVIDIA noemt nog geen Nederlandse prijs of leverdatum.

NVIDIA kondigt DGX Spark met 64 GB geheugen aan vanaf $4.999; Acer, ASUS, Dell, Gigabyte, HP en MSI starten de verkoop op 23 oktober, meldt het bedrijf.

Voor teams in Nederland verschuift de inkoopkeuze tussen een apparaat dat je vooraf betaalt en beheert, en een cloud-API waarvan de kosten met gebruik meegaan. NVIDIA noemt geen Nederlandse prijs of leverdatum; $4.999 is dus geen bevestigde winkelprijs hier.

Wat 64 GB oplevert

De 64GB-uitvoering behoudt dezelfde GB10 Grace Blackwell-chip, DGX OS en AI-software als het 128GB-model, schrijft CGMagazine. NVIDIA zegt dat de computer modellen tot 100 miljard parameters lokaal ondersteunt en hulpmiddelen als Ollama, vLLM en llama.cpp klaar heeft staan.

Diagram vergelijkt één, twee en vier DGX Spark-systemen op geheugen en rekenkracht. Bron: NVIDIA
Diagram vergelijkt één, twee en vier DGX Spark-systemen op geheugen en rekenkracht. Bron: NVIDIA

Twee Spark-systemen kunnen via NVIDIA Sync hun geheugen bundelen tot 128 GB en modellen tot 200 miljard parameters ondersteunen. In een eigen test met Qwen 3.8 27B meldt NVIDIA tot 1,7 keer de prestaties van één systeem. Dat is een fabrikantentest, geen onafhankelijke vergelijking.

De rekensom verschuift

Een cloud-API laat de kosten met het gebruik meegaan en vraagt geen eigen AI-machine vooraf. Lokale hardware verplaatst de uitgaven naar aanschaf, stroom en beheer, en kan data binnen de eigen omgeving houden als de volledige verwerking lokaal blijft.

Ook Perplexity laat zijn agent lokaal draaien op een DGX Spark of Linux-machine met minimaal 24 GB VRAM, en vraagt toestemming voor cloudhulp bij zwaardere stappen. De twee routes kunnen dus naast elkaar bestaan: lokale verwerking voor passende taken en een cloudmodel wanneer een stap meer rekenkracht vraagt.

De 64GB-versie maakt lokale capaciteit een concretere keuze: minder geheugen dan de 128GB-uitvoering, met de mogelijkheid om twee systemen te koppelen. Welke rekening lager uitvalt, hangt af van de benutting, het model en een eventuele Nederlandse partnerprijs.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van lokale AI naar werkend product

Ik denk mee over de architectuur, ontwerp de oplossing en bouw en automatiseer het hele traject tot een werkend product. Waar het kan, richt ik het in op je eigen infrastructuur.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Perplexity draait zijn AI-agent lokaal op Nvidia-hardware zonder tokenkosten
Nieuws
5 min

25 aug 16:11

Perplexity draait zijn AI-agent lokaal op Nvidia-hardware zonder tokenkosten

Perplexity lanceert Portable Computer, een agent die op je eigen Nvidia-machine draait. Lokaal werk kost geen credits, de cloud komt er alleen aan te pas als je daar per stap toestemming voor geeft.

Nvidia lanceert PAIR, gratis router die pc's tot een lokaal AI-cluster koppelt
Nieuws
5 min

4 sep 08:09

Nvidia lanceert PAIR, gratis router die pc's tot een lokaal AI-cluster koppelt

Nvidia bracht PAIR uit, gratis open source software die pc's, workstations en Macs op een netwerk tot een gedeelde inferentiepool koppelt. Lokale agents draaien zo parallel op hardware die je al hebt.

Nvidia versnelt Chinese open modellen en noemt een verbod erop een omzetrisico
Nieuws
4 min

28 aug 06:23

Nvidia versnelt Chinese open modellen en noemt een verbod erop een omzetrisico

Nvidia versnelt Qwen3.8-27B op zijn eigen RTX-kaarten en noemt in het kwartaalrapport van 26 augustus een verbod op DeepSeek, Qwen of Kimi een risico voor zijn resultaten. Die risicoparagraaf staat er al sinds februari.

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens
Nieuws
5 min

27 aug 02:22

Alibaba zet Qwen3.8-Flash-Next open en rekent 0,16 dollar per miljoen tokens

Alibaba zet de gewichten van Qwen3.8-Flash-Next open. Het model activeert 6 van 176 miljard parameters per token, kost gehost 0,16 dollar per miljoen invoertokens en komt met een strakkere licentie dan het vlaggenschip.

Qwen3.8-27B evenaart GPT-5.6 Luna in onafhankelijke meting
Nieuws
5 min

18 aug 06:23

Qwen3.8-27B evenaart GPT-5.6 Luna in onafhankelijke meting

Benchmarkbureau Artificial Analysis geeft Qwen3.8-27B een 52, gelijk aan GPT-5.6 Luna. Het model past in 17 GB op een enkele videokaart, maar verbruikt 160 miljoen tokens waar de mediaan op 43 miljoen ligt.

Abacus AI maakt gratis coding-agent open source
Nieuws
4 min

22 sep 00:26

Abacus AI maakt gratis coding-agent open source

Abacus AI brengt een gratis open-source coding-agent uit die lokaal op Windows, Mac en Linux draait. De app geeft ontwikkelteams 2.000 startcredits, eigen modelkeuze en meer dan 100 koppelingen, maar vraagt scherpe datacontrole.