Een technicus werkt aan een serverrack met netwerkbekabeling.
Nieuws15 september · 18:324 min leestijd

Delos Data lanceert Nonstop AI voor AI-clusters

Delos Data lanceert Nonstop AI met een nieuwe Data Interface en Reference Architecture. De financiering van ruim 100 miljoen dollar moet AI-clusters minder afhankelijk maken van één interconnect en ruimte geven aan heterogene hardware.

Nonstop AI, Delos Data’s nieuwe interconnectarchitectuur voor agentische AI-clusters, krijgt vandaag een Data Interface en Reference Architecture; het bedrijf meldt ruim 100 miljoen dollar financiering voor de uitrol.

Voor Nederlandse organisaties die AI via een API of cloud afnemen, verandert er vandaag niets aan product of prijs. Voor organisaties die zelf clusters bouwen of grote capaciteit inkopen, wordt de verbinding tussen GPU’s, andere accelerators, geheugen en opslag een aparte ontwerplaag naast de chip.

Delos bouwt rond gemengde AI-clusters

Delos richt Nonstop AI op agentische inferentie: workloads die continu draaien en verschillende GPU’s, XPU’s, accelerators, CPU’s, geheugen en opslag combineren. De Reference Architecture moet die endpoints als één datadomein laten werken, met ruimte voor eigen hardware, modellen en netwerktopologieën.

De uitbreiding heeft twee nieuwe kerncomponenten. Delos beschrijft de Data Interface in drie vormen: I/O-chiplet van meer dan 30 Tbps, near-packaged optics van meer dan 10 Tbps en een PCIe-kaart van meer dan 400 Gbps. All About Circuits benoemt de silicon als Apollo en de ontwikkel- en testomgeving als Morpheus.

Delos claimt 10 keer lagere latentie en 10 keer hogere efficiëntie voor de nieuwe laag. Dat zijn doelcijfers van het bedrijf, geen onafhankelijke benchmark. In een interview noemt Delos tegenover HPCwire een latentie van ongeveer 100 nanoseconden tegenover microseconden voor een gangbare netwerkkaart.

Delos Data-oprichters Ed Doe en Dan Daly voor een serverrack, bron: Delos Data
Delos Data-oprichters Ed Doe en Dan Daly voor een serverrack, bron: Delos Data

De uitrol begint vóór de definitieve clusterbouw

De ontwikkellaag is bedoeld om een clusterontwerp en verschillende netwerktopologieën vóór de ingebruikname te testen. Delos zegt dat Nonstop AI Clusters al in productie draaien bij geselecteerde klanten en dat de ontwerp- en simulatielaag nu beschikbaar is voor het samenstellen van nieuwe infrastructuur. De Nonstop AI Server moet eind 2026 bij klanten gaan samplen.

Daarmee verkoopt Delos meer dan een verbinding tussen chips. Het bedrijf haalt de keuze voor hardware, netwerkprotocollen en foutafhandeling naar een eerder moment in het ontwerp. Voor een koper van AI-capaciteit maakt dat de vergelijking breder dan GPU-type en huurprijs: ook latentie, herstel na een link- of endpointfout en de mogelijkheid om verschillende leveranciers te combineren tellen mee.

Een tweede interconnectlaag naast Cornelis

De aankondiging komt een dag na Cornelis, dat KV-cachedata, expert-dispatch en AllReduce in een open netwerkfabric wil afhandelen. Beide bedrijven maken de verbinding tussen accelerators onderdeel van de AI-architectuur, maar hun aankondigingen zijn niet hetzelfde product. Cornelis positioneert Active Compute Fabric rond rekenwerk in de fabric voor scale-up en scale-out. Delos begint bij agentische inferentie en een gemengde verzameling endpoints, modellen en topologieën.

Voor Nederlandse organisaties die AI via een dienst afnemen, blijft dit voorlopig infrastructuur achter de leverancier. Voor partijen die zelf clusters bouwen of inkopen, ontstaat wel een extra keuzelaag naast accelerator, geheugen, opslag en koeling. De interconnect wordt daarmee een onderdeel van de inkoopbeslissing, omdat ongebruikte rekentijd kan ontstaan door de chip en door de weg die de data tussen die chips aflegt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van infrastructuur naar inzet

Ik denk mee over de hele keten, ontwerp de oplossing en bouw hem door tot werkende software en automatisering, self-hosted waar dat kan. Zo blijft je technologie passend bij je proces, in plaats van andersom.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Verken verder

Concepten

LatentieInterconnectAI-interconnectAgentische inferentieInkoopbeslissing voor AI-infrastructuurAgentische AI-clustersClusterontwerpDatadomein

Gerelateerde artikelen

Cornelis introduceert Active Compute Fabric voor AI-clusters
Nieuws
4 min

15 sep 00:37

Cornelis introduceert Active Compute Fabric voor AI-clusters

Cornelis introduceert een open netwerkfabric die rekenwerk in de verbinding tussen AI-accelerators wil uitvoeren. De stap raakt Nvidia’s gesloten scale-up-laag, terwijl 205 miljoen dollar de productie en klantuitrol moet versnellen.

OpenAI brengt Data Agent naar ChatGPT Work voor bedrijfsdata
Nieuws
4 min

11 sep 18:20

OpenAI brengt Data Agent naar ChatGPT Work voor bedrijfsdata

OpenAI brengt Data Agent naar ChatGPT Work. De plugin analyseert bedrijfsdata, maakt interactieve dashboards en voert goedgekeurde acties uit. Connectoren, bedrijfsdefinities en toegangsrechten bepalen hoe bruikbaar de uitkomst wordt voor Nederlandse teams.

DeepSeek verkleint GPU-druk met Engram in V4.1-Flash
Nieuws
4 min

11 sep 10:22

DeepSeek verkleint GPU-druk met Engram in V4.1-Flash

DeepSeek V4.1-Flash koppelt 196 miljard Engram-parameters aan een kleinere KV-cache. Daardoor verschuift de infrastructuur voor lange AI-agents van alleen GPU-geheugen naar een combinatie van GPU, systeemgeheugen en opslag.

OPAQUE introduceert Weight Custody Manifest voor soevereine AI
Nieuws
4 min

10 sep 21:08

OPAQUE introduceert Weight Custody Manifest voor soevereine AI

OPAQUE introduceert een open standaard die modelgewichten pas vrijgeeft na bewijs van een goedgekeurde runtime. De technische winst is controleerbaar sleutelbeheer, niet de belofte dat klanthardware onbreekbaar wordt.

NVIDIA zet open Nemotron-stack in voor eigen supply chain
Nieuws
4 min

10 sep 12:40

NVIDIA zet open Nemotron-stack in voor eigen supply chain

NVIDIA en Palantir zetten open Nemotron-modellen in op NVIDIA’s eigen supply chain. De stack koppelt Foundry, Ontology en cuOpt aan menselijke planners, met een gespecialiseerd model dat 86,7 procent scoort op een ontwikkelbenchmark.

DeepSeek brengt V4.1-Flash uit voor multimodale agents en code
Nieuws
4 min

10 sep 12:14

DeepSeek brengt V4.1-Flash uit voor multimodale agents en code

DeepSeek brengt V4.1-Flash uit met native beeldinvoer, 1 miljoen tokens context en een tijdgebonden API-prijs. De modelkaart toont hogere scores op agentbenchmarks, terwijl caching en Nederlandse piekuren de werkelijke kosten bepalen.