Arm於近日釋出新一代半定製計算子系統平台Neoverse CSS N4,基於台積電N3P工藝,單晶片最多可整合128個Neoverse N4核心,並配備高達256MB的L3快取。這一平台面向雲服務商和晶片設計公司,允許客戶基於Arm IP快速定製滿足自身需求的晶片,是Arm在資料中心市場持續擴張的重要一步。

Neoverse CSS(Compute Subsystem)是Arm的半導體定製專案,客戶可基於Arm的IP設計晶片,並靈活配置核心數、快取大小、I/O和連線性等元件。此前,該平台已被微軟Azure、谷歌雲用於CPU設計,也被輝達和英特爾用於DPU(資料處理單元)等產品。此次釋出的N4平台,在核心數、快取、記憶體和I/O支援上均較前代N2有顯著提升。

具體來看,Neoverse CSS N4支援8至128個Neoverse N4核心,最高執行頻率為3.8GHz,但Arm未明確不同核心配置下的具體最高頻率,推測核心數增加時頻率會有所下降。系統層面,該平台支援多晶片和多插槽設計,可通過UCIe晶片間互連以及“合作伙伴特定的PNY”擴充套件到128核以上。記憶體方面,支援DDR5或LPDDR6,每晶片L3快取最高256MB;每核心配備最高2MB L2快取,以及64KB L1指令快取和64KB L1資料快取。I/O方面,支援最多128條PCIe 7/6和CXL 4.0通道。

相較之下,前代Neoverse CSS N2平台最多僅支援64核、每核1MB L2快取、64MB L3快取,記憶體支援DDR5或LPDDR5,I/O為64條PCIe 5.0/CXL通道。Arm表示,在128核、3GHz頻率、每核2MB L2快取的配置下,Neoverse CSS N4的插槽效能是Neoverse N3的兩倍,能效比提升1.25倍,記憶體頻寬提升1.75倍。

Arm的N系列核心主打能效比,而V系列核心則追求極致效能。例如,Arm自家的AGI CPU基於Neoverse V3構建,輝達上一代Grace CPU採用Neoverse V2,AWS的Graviton和谷歌雲的Axion也使用了V系列核心。N系列核心通常不用於高效能CPU,而更多用於較低效能的加速器或雲端負載,如英特爾的IPU Adapter E2100(基於Neoverse N1)和微軟Azure Cobalt 100(基於Neoverse N2)。

關於Neoverse N4核心本身(代號Dionysus),目前公開資訊有限。Arm的2024年路線圖顯示,未來還將推出Neoverse CSS V4(代號Vega)。值得注意的是,此次釋出並非面向終端產品的正式亮相,而是面向基於CSS平台進行半定製晶片開發的合作伙伴。Arm尚未公佈任何合作伙伴,但傳統上,僅少數大型CSS合同即可產生可觀收入。

與Neoverse CSS N4一同公佈的,還有Arm自家AGI晶片的更多部署進展。AGI晶片基於Neoverse V3核心,Arm透露甲骨文和字節跳動將部署該晶片,此前已公佈的部署方包括Meta、聯想、SAP、OpenAI、Cloudflare等。AGI是雙晶片設計,最多136個Neoverse V3核心、272MB L3快取,最高頻率3.7GHz,採用3nm工藝,每晶片支援高達6TB記憶體容量,執行速度可達DDR5-8800。Arm稱其記憶體和I/O與計算同置於一個晶片上,可實現低於100納秒的記憶體延遲。不過,AGI的實際效能資料尚未公開,Arm僅表示其“每機架效能比最新x86系統高出2倍以上”,但該說法基於內部估算而非真實基準測試。

Arm此次釋出Neoverse CSS N4,進一步鞏固了其在資料中心CPU市場的地位。隨著雲服務商對定製晶片需求增長,Arm的CSS平台為客戶提供了一條快速路徑,而台積電N3P工藝的採用也確保了其效能與能效優勢。未來,該平台能否吸引更多大客戶,值得關注。