Arm 宣布推出新一代 Neoverse CSS N4 運算子系統,並持續擴大 Arm AGI CPU 合作生態系,希望以客製化晶片與量產就緒處理器兩條產品路線,迎向代理式 AI(Agentic AI)需求。
代理式 AI 已經從單純生成內容,進一步發展至自主推論、擷取資料、呼叫工具及與其他代理協作,也使資料中心面臨更複雜的運算需求。Arm 表示,代理式 AI 在執行任務時,除了依賴 GPU、NPU 等加速器進行模型運算,也需要 CPU 負責資料存取、工具調用、資料庫互動、安全隔離與系統協調。隨著 AI 代理數量及工作流程複雜度持續增加,預期將進一步推升資料中心對 CPU 吞吐量、即時回應能力與能源效率的要求。
Arm 引述 IDC 相關資料指出,以 Arm 架構為基礎的機櫃級伺服器,已在加速運算市場超越 x86,反映 Arm 在 AI 資料中心的部署規模持續擴大。面對不同類型的 AI 工作負載,Arm 此次分別以 Neoverse CSS N4 及 Arm AGI CPU,提供客製化晶片與標準化部署選擇。
Neoverse CSS N4強化客製化晶片設計彈性
針對雲端服務供應商、晶片業者與系統廠商自行開發晶片的需求,Arm 推出 Neoverse CSS N4,定位為旗下至今配置彈性最高的 Neoverse 運算子系統。
Neoverse CSS 將處理器核心、互連架構、記憶體控制及系統 IP 預先整合並完成驗證,合作夥伴可在既有基礎上加入自家加速器、I/O 或其他功能,藉此降低系統整合風險,並縮短晶片從設計走向量產的時間。
Arm 表示,Neoverse CSS N4每個裸晶(die)最多可整合128個CPU核心,同時支援LPDDR6記憶體與PCIe 7.0連接規格。相較前一代Neoverse CSS N3,其整體效能最高提升至2倍、每瓦效能最高提升25%,記憶體頻寬最高則提升75%。
更高的運算密度、記憶體頻寬及I/O能力,可用於因應代理式AI所帶來的大量資料交換、加速器協調與平行運算需求。除了通用伺服器晶片,Neoverse CSS N4亦可應用於資料處理器(DPU)、網路晶片及其他針對特定工作負載設計的運算平台。
Arm也將透過Arm Total Design生態系,協助合作夥伴預先進行IP驗證與軟體開發,降低客製化晶片的開發門檻,並加快產品導入量產的速度。這套合作模式未來也將延伸至機器人等實體AI應用。
AGI CPU鎖定即時代理式AI運算
並非所有企業都有自行開發晶片的資源與需求。針對希望直接導入量產平台的雲端服務商、OEM與資料中心業者,Arm則以AGI CPU提供以Neoverse架構為基礎的完整處理器方案。
相較於著重高吞吐量及客製化彈性的Neoverse CSS N4,Arm AGI CPU更強調量產就緒與即時回應能力,鎖定需要快速處理推論、工具呼叫及多代理協作的應用場景。
Arm指出,包括OpenAI、Meta、Cloudflare、Oracle、SAP、Lenovo、Supermicro與Verda等業者,都已著手開發以Arm AGI CPU為核心的解決方案,顯示其軟硬體生態系正在逐步成形。
在更廣泛的雲端市場中,Google Cloud已在搭載Axion處理器的Google Kubernetes Engine(GKE)環境執行AI代理沙盒;Microsoft Azure則透過Cobalt 200處理器,加速沙盒內的工具執行;NVIDIA Vera CPU同樣將代理式AI工作負載列為重要應用方向。
字節跳動旗下雲端服務業者火山引擎,也正基於Arm平台打造下一代雲端服務,並規畫將首批採用Arm AGI CPU的代理沙盒方案推向市場,為大規模AI代理提供兼顧安全隔離與彈性擴充的執行環境。
從CPU延伸至代理式AI共同運算平台
Arm此次的布局,反映AI基礎架構已逐漸從單純追求模型算力,轉向CPU、加速器、記憶體、網路與軟體環境的整體協作。當AI代理開始自主執行多步驟任務,CPU在資料處理、資源調度、工具執行及安全管理上的角色也將更加重要。
隨著AI代理數量成長,資料中心將需要處理更多資料、協調更多加速器,並同時執行大量平行工作。如何提升每瓦電力、每座機櫃與每一筆基礎建設投資所能提供的運算效益,將成為雲端服務商與企業的重要課題。
透過Neoverse CSS N4與Arm AGI CPU,Arm希望同時涵蓋需要自行設計差異化晶片,以及希望快速部署量產方案的兩類客戶,並以共同的Neoverse架構與軟體生態系,維持不同平台之間的效能、能源效率及軟體相容性。這也顯示Arm的企圖已不再侷限於提供處理器IP,而是進一步成為代理式AI資料中心的共同運算基礎。