Nieuws

Processors

Arm propt tot 128 processorcores in chiplets voor servers met Neoverse CSS N4

Portret van de auteur


Arm propt tot 128 processorcores in chiplets voor servers met Neoverse CSS N4
0

Advertentie

Arm introduceert met de Neoverse CSS N4 de vierde generatie van zijn referentieplatform voor de ontwikkeling van processors. Arm promoot dit vooral als een flexibel platform wat betreft het aantal kernen, de cachegrootte, i/o en connectiviteit. 

De Britse chipontwerper biedt twee Neoverse-referentieplatforms aan: de N-serie is qua ontwerp gericht op maximale efficiëntie. Bij de V-serie draait alles dan weer om maximale prestaties. Fabrikanten die gebruikmaken van deze platforms en ten minste gedeeltelijk IP van Arm toepassen, zijn AWS, Google Cloud, Microsoft Azure, Nvidia en Marvell. Inmiddels biedt Arm met de AGI-CPU ook zijn eigen processor aan.

De opbouw toont de Neoverse N4-cpu-kernen in het midden, geflankeerd door GIC & MMU, een geheugensubsysteem en i/o-blokken. Als interconnect-fabric wordt CMN S4 gebruikt, aangevuld met een afzonderlijk Power & System-blok. Het platform zou ten opzichte van de vorige generatie, Neoverse CSS N3, twee keer zo hoge prestaties per socket, 25% betere prestaties per watt en een 75% hogere geheugenbandbreedte moeten leveren. De vergelijking is gebaseerd op maximale kernconfiguraties bij een kloksnelheid van 3 GHz en 2 MB L2-cache, waarbij de N3 wordt vervaardigd op een 5nm-proces en de N4 op het TSMC's N3P-node. Een deel van de efficiëntiewinst lijkt op zijn minst verklaard te worden door het verbeterde productieproces.

In vergelijking met de huidige generatie is er vooral wat betreft de kerndichtheid een duidelijke sprong voorwaarts: Neoverse CSS N3, dat in februari 2024 werd geïntroduceerd, schaalt volgens Arm zelf van 8 tot maximaal 32 kernen per chiplet en is gebaseerd op het CMN S3, MMU S3 en NOC S3. Het platform werd in de eerste plaats gepositioneerd voor 5G-infrastructuur, DPU’s (Data Processing Units) en bedrijfsnetwerken. 

CSS N4 verviervoudigt de maximale kerndichtheid per chiplet tot 128 kernen en verschuift daarmee duidelijk de focus: In plaats van zich voornamelijk te richten op netwerk- en edge-workloads, richt Arm zich met CSS N4 expliciet op agent-gebaseerde AI-workloads – dat wil zeggen toepassingen waarbij autonome AI-agenten continu berekeningen uitvoeren en daarvoor een hoge kerndichtheid en geheugenbandbreedte nodig hebben.

Verder is er onder andere tot 256 MB systeemcache per die beschikbaar. Wanneer meerdere dies met CPU-kernen worden gebruikt, zijn deze via ucie met elkaar verbonden. Bovendien ondersteunen de i/o-blokken lpddr6, pcie 6.0 en 7.0 met maximaal 128 lanes, evenals CXL 4.0.

Deze herpositionering van een puur netwerk-/edge-component naar een platform dat specifiek is afgestemd op agent-gebaseerde AI-workloads past in het bredere patroon van het tegelijkertijd geïntroduceerde mobiele platform CSS for Mobile 2, dat eveneens als AI-native wordt bestempeld.

Terug naar boven