De Frontier-supercomputer is 's werelds toonaangevende supercomputer en de enige Exascale-supercomputer die momenteel in gebruik is. Aangedreven door AMD's EPYC- en Instinct-hardware, levert deze machine niet alleen HPC-prestaties van het hoogste niveau, maar is hij ook de op één na meest efficiënte supercomputer ter wereld. Uit een rapport ingediend op preprint Arxiv blijkt dat de Frontier-supercomputer het vermogen heeft bereikt om een biljoen parameters te trainen door middel van "hyperparameteraanpassing", wat vergelijkbaar is met GPT-4 en een nieuwe benchmark voor de industrie heeft gezet.
Laten we eerst kort de voordelen van de Frontier-supercomputer bekijken. De supercomputer van ORNL maakt vanaf het begin gebruik van AMD's derde generatie EPYCTrento CPU en InstinctMI250X GPU-accelerator. Het is geïnstalleerd in het Oak Ridge National Laboratory (ORNL) in Tennessee, VS, en wordt beheerd door het Department of Energy (DOE). Momenteel haalt het een snelheid van 1,194 Exaflop/s met behulp van 8.699.904 cores. HPECrayEX-architectuur combineert AMDEPY CCPU van de 3e generatie, geoptimaliseerd voor HPC en AI, AMDInstinct250X-accelerator en Slingshot-11-interconnect. Op de Supercomputer Top500.org-lijst heeft Frontier zijn eerste positie behouden, wat zijn dominantie aantoont.
Het nieuwe record van Frontier is het resultaat van de implementatie van effectieve strategieën om LLM te trainen en het meest efficiënte gebruik van ingebouwde hardware. Het team behaalde opmerkelijke resultaten door uitgebreid testen van 22 miljard, 175 miljard en 1 biljoen parameters. Deze cijfers zijn het resultaat van het optimaliseren en verfijnen van het modeltrainingsproces. Deze resultaten werden bereikt met slechts 3.000 AMD MI250XAI-accelerators, die krachtige prestaties laten zien ondanks dat ze relatief verouderde hardware zijn.
Wat interessanter is, is dat de hele 'frontier'-supercomputer 37.000 MI250XGPU's heeft, dus je kunt je de prestaties voorstellen als je de hele pool van GPU's gebruikt om rekenkracht aan LLM te leveren. AMD staat ook op het punt zijn MI300 GPU-versneller te implementeren in een nieuwe supercomputer, uitgerust met een krachtig ROCm6.0-ecosysteem om de prestaties van kunstmatige intelligentie verder te versnellen.
De toekomst van servers en datacenters ziet er rooskleurig uit, en het is vermeldenswaard dat de hardware die momenteel door Frontier wordt gebruikt niet nieuw is in de branche. Naarmate het gebied van generatieve kunstmatige intelligentie zich blijft ontwikkelen, is het duidelijk dat de toekomstige markt meer rekenkracht nodig zal hebben. Daarom zullen verbeteringen in hardware die voor dit gebied is ontworpen van cruciaal belang zijn voor de ontwikkeling van de volgende generatie.