Arm正式發表第二代行動裝置運算子系統CSS for Mobile 2,整合全新C2 CPU叢集、Mali G2-Ultra NX GPU及系統IP,鎖定裝置端代理式AI與神經圖像等新一代行動應用,藉此加速手機乃至平板等行動裝置廠商因應市場變化,規劃 AI 新機上市時程。
CSS for Mobile 2採用預先整合及驗證的運算子系統設計,協助晶片業者降低CPU、GPU與系統IP的整合複雜度,縮短晶片設計及產品上市時間。對軟體開發者而言,Arm則希望藉由一致的平台架構與開發工具,降低AI應用部署至不同裝置的門檻。
圖像運算可說是此次平台升級重點。全新Mali G2-Ultra NX成為Arm首款整合專用神經網路加速器的Mali GPU,能在同一條處理管線中結合傳統圖像渲染與神經網路運算。
這項設計可透過AI重建、強化或生成畫面細節,在降低渲染負擔的同時,提高遊戲解析度、光影品質及畫面流暢度。Arm表示,Mali G2-Ultra NX的神經圖像每瓦效能最高可提升4倍,既有遊戲內容的傳統圖像效能相較前一代則最高提升14%。
新GPU也導入重新設計的執行引擎與新一代光線追蹤單元,以因應行動遊戲日益複雜的光影效果與運算需求。
Arm已與Sumo Digital合作推出《光影新生》(Neural Dawn)技術展示,騰訊遊戲、Unity China及網易遊戲等業者也開始導入相關技術。其中,網易《燕雲十六聲》預計推出支援神經超級取樣(NSS)的版本,《暗區突圍:無限》及《無限暖暖》也已進行相關功能展示或整合。
C2 CPU叢集強化裝置端AI效能
面對代理式AI需要持續維持上下文、安排工作流程、呼叫工具與協調不同模型的需求,Arm認為CPU將扮演整個運算系統的「編排引擎」,不再只是執行一般應用程式。
全新C2 CPU叢集由旗艦級C2-Ultra、強調能源效率的C2-Pro,以及兩組第二代可擴展矩陣延伸指令集(SME2)單元組成,可直接加速裝置端AI工作負載,並與GPU及其他AI加速器協同運作。
根據Arm公布的數據,C2 CPU叢集將SME2運算能力提高一倍,可讓最新小型語言模型的執行速度提升70%。與前一代C1-Ultra相比,C2-Ultra的AI效能最高提升1.7倍、單執行緒效能提高15%,在相同性能下的功耗則最高降低38%。
SME2目前已導入部分旗艦Android及iOS裝置,合作生態系涵蓋支付寶、Google AI Edge Gallery、OPPO與vivo等業者。
軟硬體同步布局行動AI生態系
除了硬體架構,Arm也透過KleidiAI、Arm神經圖像開發套件及開放介面,協助開發者將AI模型與神經圖像功能導入應用程式。同步推出的Arm AI Portal則提供單一入口,讓開發者尋找、評估及使用經過最佳化的模型、程式碼與工具。
CSS for Mobile 2反映行動晶片的競爭方向,正從單純比較CPU、GPU或NPU效能,轉向整體系統的協同運算能力。未來智慧型手機若要讓AI代理長時間在背景運作,同時兼顧即時回應、圖像品質、功耗與散熱,就不能只依賴單一AI加速器,而需要CPU、GPU及系統IP共同參與。
透過C2 CPU叢集與Mali G2-Ultra NX,Arm希望為晶片業者提供一套可快速導入的AI原生行動平台,也提前布局代理式AI與神經圖像可能帶來的下一波換機需求。