VMware Private AI Cloud: een privécloud, agenten en inferentie op een platform

Broadcom presenteert VMware Private AI Cloud, een oplossing die private cloud-infrastructuur, inferentiediensten, AI-agenten en traditionele zakelijke applicaties integreert op VMware Cloud Foundation (VCF). Het doel is dat organisaties modellen kunnen uitvoeren dicht bij hun data, GPU- en tokengebruik beheren, en veiligheids- en governancebeleid toepassen zonder een volledig aparte AI-platform te creëren dat losstaat van hun bestaande infrastructuur.

De kernpunten van VMware Private AI Cloud in 20 seconden

  • VMware Private AI Cloud is gebaseerd op VMware Cloud Foundation 9.
  • Combineert virtuele machines, Kubernetes, inferentie en AI-agenten.
  • Inclusief VMware AI Factory voor geautomatiseerde deploy vanaf hardware tot modellen.
  • VCF ondersteunt meer dan 150 modellen en verschillende accelerators.
  • Broadcom voegt specifieke controles toe voor agenten, data en AI-applicaties.

De aankondiging tijdens VMware Explore 2026 bundelt diverse innovaties rondom kunstmatige intelligentie binnen één architectuur. VMware AI Factory verzorgt de automatiseringlaag; AgentMinder bewaakt de acties van agenten; Tanzu beheert applicaties en data; terwijl vDefend en Avi Load Balancer beveiligingsmechanismen bieden voor deze nieuwe workloads.

De overkoepelende gedachte is eenvoudig: breng het model naar de data in plaats van data naar een extern model.

Voor sommige organisaties is deze aanpak vooral belangrijk wanneer modellen toegang moeten krijgen tot interne documentatie, code, databases of gegevens onder strikte regelgeving. Het uitvoeren van inferentie binnen gecontroleerde infrastructuur lost niet automatisch alle beveiligings- of compliance-problemen op, maar biedt wel meer controle over waar data wordt verwerkt en welke systemen dat mogen doen.

Private cloud beheert nu ook GPU’s, modellen en tokens

VMware Cloud Foundation levert al jaren infrastructuur voor virtuele machines en zakelijke applicaties. Broadcom breidt dit concept nu uit door AI als een standaard workload te behandelen op dezelfde platformen.

Dit vereist beheer van middelen die voorheen niet tot de dagelijkse werking van veel datacenters behoorden, zoals GPU’s.

VCF ondersteunt accelerators en processors van diverse fabrikanten, terwijl Broadcom samenwerkt met serverfabrikanten om compatibele configuraties te bieden. Het doel is voorkomen dat elke AI-project zijn eigen geïsoleerde hardware-omgeving moet opzetten.

De capaciteit kan gedeeld worden tussen afdelingen, applicaties en modellen.

Het model sharing multi-tenant maakt het bijvoorbeeld mogelijk dat verschillende bedrijfsunits dezelfde modelinstantie gebruiken, terwijl ze gescheiden blijven, in plaats van telkens nieuwe hardware te reserveren voor dezelfde architectuur.

Broadcom verhoogt ook de zichtbaarheid van GPU- en vGPU-gebruik en voegt metrics toe voor tokens, latentie, computation en geheugen.

Hier duikt een term op die regelmatig gebruikt wordt door Broadcom tijdens VMware Explore 2026: AI tokenomics.

In AI-diensten wordt de kost meestal uitgedrukt per token of verzoek. Wanneer het model op eigen infrastructuur draait, wordt de factuur verdeeld over servers, accelerators, opslag, energie, licenties en personeel.

Tokenkosten blijven bestaan, maar zijn minder zichtbaar.

Door het aantal tokens dat een infrastructuur produceert te meten, en te analyseren welk aandeel CPU, GPU en geheugen wordt gebruikt, kunnen verschillende configuraties beter vergeleken worden.

Broadcom noemt in dit verband ook functies van VCF 9 zoals NVMe memory tiering en gedupliceerde opslag op clusterniveau, om hardwarebehoeften te reduceren. De daadwerkelijke voordelen hangen af van de workload, de dataset en de gebruikte configuratie.

Private cloud is niet per se goedkoper dan een externe API. Voor kleine, variabele of experimentele projecten kan betalen per gebruik efficiënter zijn dan investeren in accelerators die later deels ongebruikt blijven.

De economie verbetert wanneer workloads stabiel zijn, er voldoende gebruikers zijn en hardware optimaal wordt benut.

VMware AI Factory verbindt fysieke servers met het eerste model

De operationele basis van VMware Private AI Cloud is VMware AI Factory, eveneens aangekondigd door Broadcom tijdens VMware Explore.

Deze laag automatiseert het proces vanaf serverconfiguratie tot het uitrollen van inferentiediensten.

Broadcom beweert dat sommige installaties van weken snel kunnen worden teruggebracht tot uren. Dit is een ambitie, geen garantie, omdat elke omgeving uniek is qua netwerkinfrastructuur, firmware, beveiliging en hardware.

De integratie met MetalSoft moet deze automatisering uitbreiden tot bare metal servers.

VCF kan fysieke hardware van verschillende fabrikanten voorbereiden of herstellen via de beheerconsole, en vervolgens de deployment van vSphere, vSAN, Kubernetes en GPU-componenten coördineren.

Broadcom breidt ook de opties voor acceleratie uit.

Samen met AMD ontwikkelt Broadcom een configuratie van VMware AI Factory gebaseerd op AMD Instinct en ROCm. VCF blijft ondersteuning bieden voor diverse CPU- en GPU-architecturen.

Hierop kunnen modellen draaien.

Broadcom stelt dat VMware Cloud Foundation meer dan 150 open en commerciele modellen ondersteunt, met specifieke validaties voor NVIDIA Nemotron 3, Google DeepMind Gemma 4, NEC cotomi, Qwen en GLM 5.2 van Z.ai.

Het doel is om deze modellen intern aan te bieden als Model as a Service.

In plaats van dat elk developmentteam zelf LLM’s installeert en onderhoudt, kan de platformafdeling een beheerde catalogus leveren. Applicaties kunnen die modellen gebruiken via interne services volgens gemeenschappelijke beleidsregels.

De toekomstige AI Gateway brengt dit verder met een interface voor lokale en externe modellen, inclusief applicatieautorisatie, gebruiksbeperkingen en modelselectiemechanismen.

Dit leidt tot een hybride architectuur.

Een bedrijf kan een klein, lokaal model gebruiken voor veel interne vragen, een groter model reserveren voor specifieke taken, en een publieke provider inschakelen voor capaciteit die intern niet beschikbaar is.

Agenten forceren herziening van beveiliging in private cloud

De meest opvallende innovatie van VMware Private AI Cloud ligt waarschijnlijk niet in het uitvoeren van modellen, maar in het beheren van agenten die acties kunnen ondernemen op andere systemen.

Een model dat enkel tekst genereert, brengt relatief beperkte risico’s met zich mee. Een agent kan API’s raadplegen, data lezen, tools gebruiken, applicaties aanpassen of code uitvoeren.

Broadcom voegt specifieke controles toe voor deze situatie.

AgentMinder voorziet agenten van identiteiten en koppelt hun toestemming aan een missie, goedgekeurde tools en beschikbare resources.

Operaties worden gecontroleerd tijdens uitvoering, zodat een initiële geldige identiteit niet automatisch toestemming geeft voor alle daaropvolgende acties.

Tanzu Platform adopteert een andere aanpak: een deny by default-architectuur.

Agenten krijgen geen toegang tot API’s, netwerken, MCP-servers (Model Context Protocol) of internet, tenzij expliciet toegestaan. Broadcom brengt ook een geïsoleerde credential store uit, zodat agenten geen directe toegang tot geheime gegevens krijgen die anders mogelijk worden blootgelegd door een kwaadaardige instructie.

Deze aanpak address het vooral het risico van prompt injection.

Een agent kan een document, e-mail of webpagina verwerken die instructies bevat om het gedrag te wijzigen. Als de agent over zichtbare credentials en ruime permissies beschikt, wordt de potentiële impact groter.

Het voorkomen dat de agent deze gegevens kent en het extern beperken van gebruikte tools vermindert dat risico, maar elimineert het niet volledig.

Broadcom ontwikkelt ook Secure AI Sandboxes, virtuele omgevingen waar gegenereerde code door agenten kan draaien zonder direct toegang te geven tot de rest van de infrastructuur.

vDefend breidt daarnaast zijn Zero Trust-mechanismen uit naar agenten- workloads.

Broadcom kondigt functies aan voor continue traffic-analyse om componenten gerelateerd aan agenten te identificeren, ongeautoriseerd gebruik van AI-tools te detecteren en IA-gestuurde intrusion detection en prevention systemen (IDPS) toe te passen.

Sommige functies worden voor toekomstige versies aangekondigd; ze zijn niet meteen beschikbaar.

Avi Load Balancer zal ook de bescherming uitbreiden door te bepalen welke tools agenten mogen gebruiken, afwijkingen te detecteren en pogingen tot het afhandelen van gevoelige data te beperken.

Deze combinatie betekent een grote sprong voorwaarts ten opzichte van de eerste generatie zakelijke AI-platformen.

Het draait niet alleen meer om het draaien van modellen in datacenters. De platformen moeten nu controleren wie ze mag gebruiken, welke data ze ontvangen, welke tools worden ingezet en wat er gebeurt wanneer een agent een actie probeert uit te voeren.

Broadcom verbindt ook Tanzu met data-voorbereiding voor AI. Data-eigenaren kunnen gestructureerde en ongestructureerde data transformeren tot beheerde data-products die door applicaties en agenten kunnen worden gebruikt.

Zo wordt toegang tot data losgekoppeld van directe toegang tot de originele systemen.

Een applicatie kan bijvoorbeeld gegevens ontvangen die specifiek zijn voorbereid voor haar taak, zonder volledige toegang tot de gehele bedrijfsdatabase.

VMware Private AI Cloud streeft ernaar de traditionele cloudbegrip uit te breiden. De platform blijft virtuele machines, Kubernetes en reguliere applicaties hosten, maar voegt modellen, GPU’s, agenten, dataproducten en tokengebruik toe als resources die ook beheerd moeten worden.

De waarde van deze benadering hangt sterk af van de mate waarin systemen deze workloads kunnen beheren zonder extra complexiteit toe te voegen.

Broadcom inzet op integratie in bestaande VCF-tools, in plaats van een volledig onafhankelijke AI-infrastructuur op te zetten.

Dit kan een belangrijke discussie worden voor datacenters in de komende jaren. AI op eigen infrastructuur uitvoeren is technisch mogelijk, maar de uitdaging ligt in het herhaalbaar, governance- en kosten-efficiënt maken wanneer modellen onderdeel worden van productieapplicaties.

Veelgestelde vragen

Wat is VMware Private AI Cloud?

Broadcoms voorstel om inferentie, modellen en agenten van AI binnen VMware Cloud Foundation te draaien en beheren, naast virtuele machines, Kubernetes en andere bedrijfsapplicaties.

Wat is de relatie tussen VMware Private AI Cloud en VMware AI Factory?

VMware AI Factory is de automatiseringslaag van VMware Private AI Cloud, die het volledige proces automatiseert van serverconfiguratie tot het uitrollen van AI-inferentiediensten.

Welke AI-modellen ondersteunt VMware Cloud Foundation?

Broadcom beweert dat VCF meer dan 150 modellen draait, met valideringen voor Nemotron 3, Gemma 4, cotomi, Qwen en GLM 5.2 van Z.ai, onder andere.

Voorkomt VMware Private AI Cloud dat data het bedrijf verlaat?

Door modellen en applicaties binnen private infrastructuur te draaien, is het mogelijk bepaalde data veilig te houden. Toch hangt het daadwerkelijke databeheer af van de architectuur, applicaties en externe diensten die een organisatie inzet.

Scroll naar boven