Broadcom lanceert VMware Private AI Cloud, een platform waarop AI-inferentie, AI-agents en klassieke virtuele machines samen op VMware Cloud Foundation draaien, kondigde het bedrijf aan op VMware Explore in Las Vegas.
Voor Nederlandse IT-afdelingen die na de licentieschok nog kiezen tussen blijven op VCF of vertrekken, verandert de inhoud van die afweging. Broadcom legt de complete AI-laag boven op het abonnement dat je toch al betaalt. De VMware AI Factory is geen apart product en kost niets extra, zei Prashanth Shenoy, marketingdirecteur van de VCF-divisie, tegen Network World. Draai je gevoelige data in je eigen datacenter en wil je daar modellen naast zetten, dan koop je die stap niet apart in. Zit je midden in een vertrek bij Broadcom, dan verandert er aan je licentierekening per core niets.
Een platform voor VM's, containers en inferentie
Private AI Cloud is geen nieuw product maar een bundeling. Broadcom zet VMware Cloud Foundation 9 neer als een privécloudplatform dat inferentieworkloads, agentic applicaties en gewone bedrijfsapplicaties naast elkaar draait, met daarbovenop de VMware AI Factory, het Tanzu Platform voor agents, AgentMinder voor agentbeheer en vDefend en Avi Load Balancer voor beveiliging. Onafhankelijke tests onder MLPerf Inference v5.1 moeten aantonen dat VCF daarbij gelijk opgaat met bare metal.
De onderbouwing komt uit eigen onderzoek: volgens Broadcoms Private Cloud Outlook 2026 draait 56 procent van de bedrijven productie-inferentie al op een privécloud of is dat van plan. Dat cijfer komt van de leverancier zelf, dus het is een verkoopargument en geen neutrale meting.

De AI Factory is de automatiseringslaag eronder. Die regelt hardwareprovisioning, het uitrollen van de softwarestack en het levenscyclusbeheer, en moet de tijd van een kale server tot het eerste draaiende AI-model terugbrengen van weken naar uren. Voor de fysieke laag sluit Broadcom een partnerschap met MetalSoft, dat servers van verschillende leveranciers vanuit de VCF-beheerconsole moet kunnen uitrollen of opnieuw inrichten. Gecertificeerde AI ReadyNodes komen van Cisco, Dell Technologies, Lenovo en Supermicro. Voor versnellers werkt Broadcom samen met AMD aan een variant op Instinct MI350-GPU's met de ROCm-stack, naast bestaande ondersteuning voor Intel en Nvidia.
Vijf modellen erbij, vLLM als standaard
vLLM wordt de standaard modelruntime, waarmee meer dan 150 open source modellen op VCF kunnen draaien. Broadcom noemt vijf modellen die nu getest en gevalideerd zijn:
- Nemotron 3 van Nvidia: open multimodale modelfamilie met een hybride Mamba-Transformer-MoE-architectuur en een contextvenster van een miljoen tokens.
- Gemma 4 van Google DeepMind: open-weight multimodale modellen, bedoeld voor lokale uitvoering.
- cotomi van NEC: gericht op het Japans, met een verbetering van 40 procent in tokenefficiëntie.
- Qwen 3.7-Max van Alibaba: propriëtair multimodaal model met eveneens een miljoen tokens context.
- GLM 5.2 van Z.ai: open source, gericht op code- en redeneeragents.
Dat rijtje is voor een Nederlandse organisatie relevanter dan het lijkt. Twee van de vijf komen uit China en een uit Japan, dus wie om juridische redenen geen Amerikaanse cloud gebruikt, hoeft niet automatisch voor een Amerikaans model te kiezen. En omdat de modellen op eigen hardware draaien, verdwijnt de tokenrekening. AMD wijst daar in zijn commentaar bij de aankondiging zelf op: voorspelbare kosten zonder prijs per token.
AgentMinder is er nu, de rest komt later
Dit is een lanceringsevenement, dus het onderscheid tussen beschikbaar en aangekondigd telt. AgentMinder, de centrale besturingslaag voor autonome agents, is vanaf vandaag algemeen beschikbaar. Het geeft elke agent een eigen bedrijfsidentiteit en bindt zijn bevoegdheid aan een vooraf verklaarde opdracht, goedgekeurde tools en toegestane bronnen. Elke aanroep wordt tijdens de uitvoering opnieuw getoetst en vastgelegd. Broadcom gebruikt het zelf voor pieken van bijna 36 miljoen klantgerelateerde en zeven miljoen medewerkergerelateerde API-aanroepen per dag, over 20 miljoen klantidentiteiten.
Ook vandaag al bruikbaar: modellen delen tussen tenants of bedrijfsonderdelen via gescheiden namespaces, zodat meerdere afdelingen dezelfde GPU-capaciteit gebruiken in plaats van elk hun eigen kopie van een model.
Nog niet beschikbaar zijn de AI Gateway met promptrouting en tokenlimieten, de beveiligde sandboxes voor code die agents zelf genereren, de zerotrustuitbreidingen voor agents in vDefend en de agentbescherming in Avi Load Balancer. Die staan in de aankondiging consequent in de toekomende tijd. De agentfuncties in het Tanzu Platform worden in het najaar van 2026 algemeen beschikbaar.
De licentie blijft de rekensom
Het aanbod landt bij een klantenbestand dat niet warmloopt. Uit Gartner-onderzoek blijkt dat 76 procent van de IT-leiders en CIO's negatief kijkt naar het eigenaarschap van VMware door Broadcom, tegen 64 procent in 2025. Van dezelfde groep zoekt 67 procent naar alternatieven en is 35 procent al aan het migreren of daarmee klaar. Gartner verwacht dat in 2029 55 procent van de bedrijven al hun VMware-workloads heeft verplaatst.
De timing is ook niet vroeg. IDC-analist Matthew Flug tekent aan dat vrijwel elke leverancier die hij de afgelopen twee maanden sprak al een AI-gateway of modelrouter had uitgebracht, waardoor Broadcom aan de late kant is hoe degelijk het werk ook is. Volgens diezelfde inventarisatie draaien inmiddels ongeveer 3.000 klanten op VCF 9.
Daar komt de kostenkant bij die los van deze aankondiging al vaststond. Microsoft schrapt de meegeleverde VMware-licentie uit Azure VMware Solution, waardoor pay-as-you-go-omgevingen op 31 oktober 2026 en reserveringen op 30 augustus 2027 over moeten op een eigen VCF-abonnement. Broadcom rekent per core met een minimum van zestien fysieke cores per CPU. Een uitbreiding met GPU-nodes voor AI verhoogt dus niet alleen de hardwarerekening, maar ook de licentierekening.
Daarmee verschuift het gesprek over VMware van prijs naar plaats. Broadcom verkoopt niet langer alleen virtualisatie, maar de belofte dat inferentie, agents en de data waar ze op werken binnen dezelfde muren blijven. Dat is precies de vraag die ook speelt rond de soevereine overheidscloud en de Nederlandse AI-clouds die dit jaar opkomen: waar je data staat en van wie je software is, is een bedrijfsrisico en geen politiek standpunt. Wie die afweging maakt, rekent vanaf nu niet alleen door wat een hypervisor kost, maar ook wat het kost om AI ergens anders te laten draaien dan waar de data staat.
Veelgestelde vragen
AI op je eigen infrastructuur
Wil je AI draaien op je eigen servers in plaats van bij een leverancier die de prijs bepaalt? Ik denk mee over de opzet, ontwerp de oplossing en bouw en automatiseer hem, self-hosted waar dat kan.
Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.
