Microsoft onthulde tijdens zijn jaarlijkse Ignite-conferentie twee op maat gemaakte chips gericht op kunstmatige intelligentie-workloads. De Microsoft Azure Maia AI-accelerator wordt gebruikt voor kunstmatige-intelligentietaken en generatieve kunstmatige intelligentie, terwijl Microsoft Azure Cobalt een ARM-processor is voor algemene computerwerklasten in de Microsoft-cloud.
Het concept van het project is om "alles, van chips tot diensten" aan te passen om te voldoen aan de behoeften van moderne kunstmatige intelligentie. Naast het maken van de interne chips zorgde Microsoft er ook voor dat al het andere werd geoptimaliseerd voor AI-workloads, zoals software, serverracks en koelsystemen.
Microsoft bouwt de infrastructuur om AI-innovatie te ondersteunen, en we herdenken elk aspect van het datacenter om aan de behoeften van de klant te voldoen. Op operationele schaal is het belangrijk om elke laag van de infrastructuurstack te optimaliseren en te integreren om de prestaties te maximaliseren, de toeleveringsketen te diversifiëren en klanten infrastructuurkeuze te bieden.
Microsoft zegt dat de AzurMaia AI-accelerator speciaal is ontworpen voor de Azure-hardwarestack, waardoor "het absoluut maximale gebruik van de hardware" mogelijk wordt gemaakt. Wat Azure Cobalt betreft, het is een energiezuinige ARM-chip voor cloud-native producten met een geoptimaliseerde prestatie-per-watt-verhouding in het datacenter.
Om de nieuwe chips binnen de bestaande datacenterinfrastructuur te kunnen huisvesten, heeft Microsoft zijn serverracks opnieuw ontworpen (de nieuwe processors vereisen bredere printplaten) en een oplossing voor vloeistofkoeling geïmplementeerd. Het bedrijf zal begin volgend jaar nieuwe kunstmatige-intelligentieprocessors uitrollen naar datacenters, die in eerste instantie rekenkracht zullen leveren aan Microsoft Copilot en Azure Open AI Service.
Naast het lanceren van AI-specifieke chips, breidt Microsoft ook de samenwerking met andere fabrikanten uit om klanten meer keuzemogelijkheden te bieden. Microsoft heeft een preview gelanceerd van een nieuwe virtuele machine, aangedreven door NVIDIA's H100 TensorCore GPU. Daarnaast is de softwaregigant ook van plan Nvidia's H200TensorCore en AMD's MI300X te gebruiken. Deze nieuwe toevoegingen zullen prestaties, betrouwbaarheid en efficiëntie toevoegen aan middel- tot high-end training en generatieve AI.