Een opeenstapeling van kostenposten en compliance-problemen is in één stap te elimineren. Dat is de belofte achter VMware Private AI Cloud, een oplossing van Broadcom die virtualisatie en LLM’s koppelt om een veiliger alternatief te geven voor AI-gebruik.
Private AI Cloud is onlosmakelijk verbonden met VMware Cloud Foundation 9, de infrastructuurlaag van VMware by Broadcom die alle onderhuidse systemen van IT en AI combineert. Dat is nu meer het geval dan voorheen, met gevalideerde LLM’s en op ’tokenomics’ gerichte configuraties die AI-gebruik betaalbaar dienen te houden.
Het uitgangspunt van Broadcom is simpel. Men stelt simpelweg: breng het model naar de data, niet andersom. Met VMware Private AI Cloud wil het bedrijf organisaties een route bieden om AI-workloads te bouwen binnen een volwassen en compliant IT-systeem, waarbij het draaien en beheren van de workloads volledig binnen de eigen infrastructuur plaatsvindt indien nodig. Klanten kiezen daarbij zelf hun hardware, accelerators en modellen.
Model naar de data, niet data naar het model
Dit gaat dieper dan alleen een basaal alternatief voor API-gebruik. Vorig jaar maakte Broadcom VMware ‘AI-native’ met VCF 9 en Private AI Services, waarbij zaken als GPU-monitoring, model runtime en vector databases standaard onderdeel werden van het platform. De nieuwe aankondigingen bouwen daar rechtstreeks op voort en profiteren van het feit dat open AI-modellen een stuk competitiever en bruikbaarder zijn dan toen VCF 9 medio vorig jaar lanceerde.
VMware AI Factory is de software-defined basis onder de Private AI Cloud; hierbij is met name voor een AMD-samenwerking gekozen. Broadcom claimt dat de tijd tussen het uitrollen van een fysieke server en het serveren van een eerste AI-model daalt van weken naar uren. Provisioning van hardware, het inschakelen van de softwarestack en lifecycle management verlopen volledig geautomatiseerd. Hoewel de naam van AMD acht keer valt in de aankondiging, dienen we niet te vergeten dat dit alles ook met Nvidia mogelijk is, waar al voorheen een partnership mee was.
Vele features
Om de AI-uitrol verder te versnellen sluit Broadcom een partnerschap met MetalSoft voor heterogene bare metal-automation. Beheerders kunnen fysieke servers van meerdere leveranciers direct via de VCF-managementconsole provisionen of opnieuw inrichten.
Daarnaast introduceert Broadcom private AI services zoals multi-tenant model sharing via geïsoleerde namespaces, een AI Gateway met prompt routing en token rate-limiting, en beveiligde AI-sandboxes voor code die door agents wordt gegenereerd. GPU-resources worden gepoold en gedeeld, zodat meerdere modellen op dezelfde hardware draaien. Het logisch opsplitsen van GPU’s is regelmatig een pijnpunt gebleken, waardoor organisaties per GPU dienden te provisionen in plaats van dat men alle rekenkracht op een stapel kon werpen. Dat laatste is nu wel mogelijk.
Meer dan 150 modellen gevalideerd
VCF-klanten kunnen inmiddels meer dan 150 open source en commerciële modellen draaien, met vLLM als standaard runtime. Broadcom valideerde specifiek Nemotron 3 van Nvidia, Google DeepMinds Gemma 4, NEC’s Japanse model cotomi, Alibaba’s Qwen3.8-27B en GLM 5.2 van Z.ai. Ondersteuning voor AMD-, Intel- en Nvidia-hardware moet vendor lock-in beperken.
Voor de agentic laag onthulde Broadcom AgentMinder, een centrale bestuurlaag die AI-agents behandelt als enterprise-identiteiten. Hun bevoegdheden worden gekoppeld aan een specifieke opdracht, goedgekeurde tools en geautoriseerde resources, met runtime policy enforcement en auditlogging. Tanzu Platform hanteert een deny-by-default runtime: agents krijgen geen toegang tot API’s, netwerken, MCP-servers of internet tenzij expliciet toegestaan.
Op beveiligingsvlak breidt vDefend laterale security op basis van zero trust uit naar agentic workloads, inclusief detectie van shadow AI, ofwel het niet gepermitteerd of onbekend gebruik van AI door werknemers. De Avi Load Balancer moet voorkomen dat agents ongeautoriseerde tools benaderen of gevoelige data exfiltreren.
Volgens Broadcom is er geen twijfel over de wens bij klanten voor bovenstaande features. Uit de eigen Private Cloud Outlook 2026 blijkt 56 procent van de organisaties die werd benaderd, AI-inferencing al op private cloud-basis draait of dat van plan is. Public cloud daalde voor diezelfde workloads in een jaar tijd naar 41 procent, een opvallend teken van twijfel over de AI-aanpak die de hyperscalers najagen.