Microsoft gaat de AMD Helios Rackscale Solution inzetten voor AI-inferencing op grote schaal. Daarnaast komen er twee nieuwe EPYC-VM-series en breidt Azure zijn gebruik van Pensando DPU’s uit.
De uitbreiding raakt de volledige stack: GPU’s, CPU’s, netwerk en software. Centraal staat Helios, een open rackscale-platform dat AMD Instinct MI455X-GPU’s, EPYC “Venice”-processoren, Pensando-netwerk en ROCm-software combineert. Azure gaat het platform gebruiken voor inferencing van frontier models, Azure AI-services en klantapplicaties. AMD begint in de tweede helft van 2026 met leveren aan klanten, waaronder Microsoft.
Microsoft bood eerder al de MI300X-GPU van AMD aan als alternatief voor Nvidia binnen Azure.
Een Helios-rack bevat 72 MI455X-GPU’s, goed voor circa 2,9 exaFLOPS aan FP4-rekenkracht en 31 TB HBM4-geheugen. Elke GPU beschikt over 432 GB HBM4, wat AMD naar eigen zeggen meer geheugencapaciteit geeft dan Nvidia’s concurrerende Vera Rubin-platform.
Helios kiest bewust voor een open, Ethernet-gebaseerde aanpak in plaats van een propriëtaire interconnect.
Nieuwe VM’s en netwerklaag
Naast Helios introduceert Azure twee nieuwe VM-series op basis van de 6e generatie EPYC “Venice”-processoren. Azure HDv2 mikt op agentic AI en datapijplijnen, terwijl HXv2 zich richt op semiconductor design. Beide breiden het EPYC-aanbod van Azure verder uit.
Ook de netwerklaag krijgt aandacht. Voortbouwend op de bestaande uitrol van Pensando DPU’s integreren beide bedrijven Azure Boost met AMD-technologie. Dat moet de netwerkprestaties en verbindingsverwerking op cloudschaal verbeteren.
Frontier-modelbouwers kunnen de infrastructuur inzetten voor training en inferencing, terwijl enterprise-klanten productieworkloads draaien via Azure Foundry Managed Compute.