Technicus inspecteert serverracks met een handheld diagnoseapparaat
Nieuws31 augustus · 16:476 min leestijd

Broadcom lanceert VMware Private AI Cloud met meer dan 150 modellen op eigen infrastructuur

Broadcom bundelt AI-inferentie, agents en klassieke workloads op VMware Cloud Foundation en valideert vijf modellen voor eigen datacenters. AgentMinder is er nu, de AI Gateway en de agentbeveiliging volgen later.

Broadcom lanceert VMware Private AI Cloud, een platform waarop AI-inferentie, AI-agents en klassieke virtuele machines samen op VMware Cloud Foundation draaien, kondigde het bedrijf aan op VMware Explore in Las Vegas.

Voor Nederlandse IT-afdelingen die na de licentieschok nog kiezen tussen blijven op VCF of vertrekken, verandert de inhoud van die afweging. Broadcom legt de complete AI-laag boven op het abonnement dat je toch al betaalt. De VMware AI Factory is geen apart product en kost niets extra, zei Prashanth Shenoy, marketingdirecteur van de VCF-divisie, tegen Network World. Draai je gevoelige data in je eigen datacenter en wil je daar modellen naast zetten, dan koop je die stap niet apart in. Zit je midden in een vertrek bij Broadcom, dan verandert er aan je licentierekening per core niets.

Een platform voor VM's, containers en inferentie

Private AI Cloud is geen nieuw product maar een bundeling. Broadcom zet VMware Cloud Foundation 9 neer als een privécloudplatform dat inferentieworkloads, agentic applicaties en gewone bedrijfsapplicaties naast elkaar draait, met daarbovenop de VMware AI Factory, het Tanzu Platform voor agents, AgentMinder voor agentbeheer en vDefend en Avi Load Balancer voor beveiliging. Onafhankelijke tests onder MLPerf Inference v5.1 moeten aantonen dat VCF daarbij gelijk opgaat met bare metal.

De onderbouwing komt uit eigen onderzoek: volgens Broadcoms Private Cloud Outlook 2026 draait 56 procent van de bedrijven productie-inferentie al op een privécloud of is dat van plan. Dat cijfer komt van de leverancier zelf, dus het is een verkoopargument en geen neutrale meting.

Slide van VMware met de opbouw van een VCF-privécloud: VCF Instance met management- en workloaddomeinen, VCF Fleet met gedeelde Operations en Automation, en VCF Private Clouds. Bron: VMware Cloud Foundation Blog, Broadcom
Slide van VMware met de opbouw van een VCF-privécloud: VCF Instance met management- en workloaddomeinen, VCF Fleet met gedeelde Operations en Automation, en VCF Private Clouds. Bron: VMware Cloud Foundation Blog, Broadcom

De AI Factory is de automatiseringslaag eronder. Die regelt hardwareprovisioning, het uitrollen van de softwarestack en het levenscyclusbeheer, en moet de tijd van een kale server tot het eerste draaiende AI-model terugbrengen van weken naar uren. Voor de fysieke laag sluit Broadcom een partnerschap met MetalSoft, dat servers van verschillende leveranciers vanuit de VCF-beheerconsole moet kunnen uitrollen of opnieuw inrichten. Gecertificeerde AI ReadyNodes komen van Cisco, Dell Technologies, Lenovo en Supermicro. Voor versnellers werkt Broadcom samen met AMD aan een variant op Instinct MI350-GPU's met de ROCm-stack, naast bestaande ondersteuning voor Intel en Nvidia.

Vijf modellen erbij, vLLM als standaard

vLLM wordt de standaard modelruntime, waarmee meer dan 150 open source modellen op VCF kunnen draaien. Broadcom noemt vijf modellen die nu getest en gevalideerd zijn:

  • Nemotron 3 van Nvidia: open multimodale modelfamilie met een hybride Mamba-Transformer-MoE-architectuur en een contextvenster van een miljoen tokens.
  • Gemma 4 van Google DeepMind: open-weight multimodale modellen, bedoeld voor lokale uitvoering.
  • cotomi van NEC: gericht op het Japans, met een verbetering van 40 procent in tokenefficiëntie.
  • Qwen 3.7-Max van Alibaba: propriëtair multimodaal model met eveneens een miljoen tokens context.
  • GLM 5.2 van Z.ai: open source, gericht op code- en redeneeragents.

Dat rijtje is voor een Nederlandse organisatie relevanter dan het lijkt. Twee van de vijf komen uit China en een uit Japan, dus wie om juridische redenen geen Amerikaanse cloud gebruikt, hoeft niet automatisch voor een Amerikaans model te kiezen. En omdat de modellen op eigen hardware draaien, verdwijnt de tokenrekening. AMD wijst daar in zijn commentaar bij de aankondiging zelf op: voorspelbare kosten zonder prijs per token.

AgentMinder is er nu, de rest komt later

Dit is een lanceringsevenement, dus het onderscheid tussen beschikbaar en aangekondigd telt. AgentMinder, de centrale besturingslaag voor autonome agents, is vanaf vandaag algemeen beschikbaar. Het geeft elke agent een eigen bedrijfsidentiteit en bindt zijn bevoegdheid aan een vooraf verklaarde opdracht, goedgekeurde tools en toegestane bronnen. Elke aanroep wordt tijdens de uitvoering opnieuw getoetst en vastgelegd. Broadcom gebruikt het zelf voor pieken van bijna 36 miljoen klantgerelateerde en zeven miljoen medewerkergerelateerde API-aanroepen per dag, over 20 miljoen klantidentiteiten.

Ook vandaag al bruikbaar: modellen delen tussen tenants of bedrijfsonderdelen via gescheiden namespaces, zodat meerdere afdelingen dezelfde GPU-capaciteit gebruiken in plaats van elk hun eigen kopie van een model.

Nog niet beschikbaar zijn de AI Gateway met promptrouting en tokenlimieten, de beveiligde sandboxes voor code die agents zelf genereren, de zerotrustuitbreidingen voor agents in vDefend en de agentbescherming in Avi Load Balancer. Die staan in de aankondiging consequent in de toekomende tijd. De agentfuncties in het Tanzu Platform worden in het najaar van 2026 algemeen beschikbaar.

De licentie blijft de rekensom

Het aanbod landt bij een klantenbestand dat niet warmloopt. Uit Gartner-onderzoek blijkt dat 76 procent van de IT-leiders en CIO's negatief kijkt naar het eigenaarschap van VMware door Broadcom, tegen 64 procent in 2025. Van dezelfde groep zoekt 67 procent naar alternatieven en is 35 procent al aan het migreren of daarmee klaar. Gartner verwacht dat in 2029 55 procent van de bedrijven al hun VMware-workloads heeft verplaatst.

De timing is ook niet vroeg. IDC-analist Matthew Flug tekent aan dat vrijwel elke leverancier die hij de afgelopen twee maanden sprak al een AI-gateway of modelrouter had uitgebracht, waardoor Broadcom aan de late kant is hoe degelijk het werk ook is. Volgens diezelfde inventarisatie draaien inmiddels ongeveer 3.000 klanten op VCF 9.

Daar komt de kostenkant bij die los van deze aankondiging al vaststond. Microsoft schrapt de meegeleverde VMware-licentie uit Azure VMware Solution, waardoor pay-as-you-go-omgevingen op 31 oktober 2026 en reserveringen op 30 augustus 2027 over moeten op een eigen VCF-abonnement. Broadcom rekent per core met een minimum van zestien fysieke cores per CPU. Een uitbreiding met GPU-nodes voor AI verhoogt dus niet alleen de hardwarerekening, maar ook de licentierekening.

Daarmee verschuift het gesprek over VMware van prijs naar plaats. Broadcom verkoopt niet langer alleen virtualisatie, maar de belofte dat inferentie, agents en de data waar ze op werken binnen dezelfde muren blijven. Dat is precies de vraag die ook speelt rond de soevereine overheidscloud en de Nederlandse AI-clouds die dit jaar opkomen: waar je data staat en van wie je software is, is een bedrijfsrisico en geen politiek standpunt. Wie die afweging maakt, rekent vanaf nu niet alleen door wat een hypervisor kost, maar ook wat het kost om AI ergens anders te laten draaien dan waar de data staat.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

AI op je eigen infrastructuur

Wil je AI draaien op je eigen servers in plaats van bij een leverancier die de prijs bepaalt? Ik denk mee over de opzet, ontwerp de oplossing en bouw en automatiseer hem, self-hosted waar dat kan.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information
Nieuws
5 min

27 aug 04:09

Nvidia koopt Hugging Face voor 12,9 miljard dollar, meldt The Information

The Information meldt een akkoord van 12,9 miljard dollar, Business Insider spreekt nog van lopende gesprekken. Geen van beide bedrijven bevestigt iets. Voor teams die modellen en inferentie van de hub halen, telt de neutraliteit.

Microsoft schrapt de meegeleverde VMware-licentie uit Azure VMware Solution per 30 augustus 2027
Nieuws
5 min

20 aug 14:11

Microsoft schrapt de meegeleverde VMware-licentie uit Azure VMware Solution per 30 augustus 2027

Microsoft trekt de license-included Azure VMware Solution in. Pay-as-you-go-omgevingen moeten op 31 oktober 2026 over op een eigen VCF-abonnement van Broadcom, reserveringen krijgen tot 30 augustus 2027.

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer
Nieuws
4 min

20 jul 16:22

AMD daagt Nvidia uit met AI-racksysteem Helios, Microsoft wordt afnemer

AMD daagt Nvidia voor het eerst op systeemniveau uit met Helios, een rack-schaal AI-systeem van 72 versnellers, en strikt Microsoft als afnemer voor Azure. Hoe groot die afname is, maakten beide bedrijven niet bekend.

Rijk zet door met eigen soevereine cloud: eerste applicaties mogelijk eind 2026 in overheidsdatacenters
Nieuws
6 min

2 jul 12:22

Rijk zet door met eigen soevereine cloud: eerste applicaties mogelijk eind 2026 in overheidsdatacenters

Staatssecretaris Van der Burg meldt de Tweede Kamer dat de soevereine overheidscloud al in een proof of concept draait en eind 2026 de eerste applicaties kan hosten. Tegelijk heroverweegt het Rijk zijn virtualisatielicenties.

Hugging Face verkent verkoop van minstens 13 miljard dollar
Nieuws
4 min

23 aug 22:21

Hugging Face verkent verkoop van minstens 13 miljard dollar

Business Insider meldt dat Hugging Face een verkoop verkent van minstens 13 miljard dollar. Het bedrijf bevestigt niets. Voor teams die modellen, datasets en inferentie van de hub halen, telt vooral de eigenaarsvraag.

Microsoft wil zijn Maia 300-AI-chip mogelijk al in september onthullen
Nieuws
4 min

10 aug 20:34

Microsoft wil zijn Maia 300-AI-chip mogelijk al in september onthullen

Microsoft wil zijn AI-chip Maia 300 dit najaar onthullen, mogelijk al in september, en onderhandelt met TSMC over ruim 300.000 exemplaren voor 2027. Wat dat betekent voor Azure-klanten die nu rekenkracht inkopen.