Arm正式發表第二代行動裝置運算子系統CSS for Mobile 2,整合全新C2 CPU叢集、Mali G2-Ultra NX GPU及系統IP,鎖定裝置端代理式AI與神經圖像等新一代行動應用,藉此加速手機乃至平板等行動裝置廠商因應市場變化,規劃 AI 新機上市時程。

CSS for Mobile 2採用預先整合及驗證的運算子系統設計,協助晶片業者降低CPU、GPU與系統IP的整合複雜度,縮短晶片設計及產品上市時間。對軟體開發者而言,Arm則希望藉由一致的平台架構與開發工具,降低AI應用部署至不同裝置的門檻。

圖像運算可說是此次平台升級重點。全新Mali G2-Ultra NX成為Arm首款整合專用神經網路加速器的Mali GPU,能在同一條處理管線中結合傳統圖像渲染與神經網路運算。

這項設計可透過AI重建、強化或生成畫面細節,在降低渲染負擔的同時,提高遊戲解析度、光影品質及畫面流暢度。Arm表示,Mali G2-Ultra NX的神經圖像每瓦效能最高可提升4倍,既有遊戲內容的傳統圖像效能相較前一代則最高提升14%。

新GPU也導入重新設計的執行引擎與新一代光線追蹤單元,以因應行動遊戲日益複雜的光影效果與運算需求。

Arm已與Sumo Digital合作推出《光影新生》(Neural Dawn)技術展示,騰訊遊戲、Unity China及網易遊戲等業者也開始導入相關技術。其中,網易《燕雲十六聲》預計推出支援神經超級取樣(NSS)的版本,《暗區突圍:無限》及《無限暖暖》也已進行相關功能展示或整合。

C2 CPU叢集強化裝置端AI效能

面對代理式AI需要持續維持上下文、安排工作流程、呼叫工具與協調不同模型的需求,Arm認為CPU將扮演整個運算系統的「編排引擎」,不再只是執行一般應用程式。

全新C2 CPU叢集由旗艦級C2-Ultra、強調能源效率的C2-Pro,以及兩組第二代可擴展矩陣延伸指令集(SME2)單元組成,可直接加速裝置端AI工作負載,並與GPU及其他AI加速器協同運作。

根據Arm公布的數據,C2 CPU叢集將SME2運算能力提高一倍,可讓最新小型語言模型的執行速度提升70%。與前一代C1-Ultra相比,C2-Ultra的AI效能最高提升1.7倍、單執行緒效能提高15%,在相同性能下的功耗則最高降低38%。

SME2目前已導入部分旗艦Android及iOS裝置,合作生態系涵蓋支付寶、Google AI Edge Gallery、OPPO與vivo等業者。

軟硬體同步布局行動AI生態系

除了硬體架構,Arm也透過KleidiAI、Arm神經圖像開發套件及開放介面,協助開發者將AI模型與神經圖像功能導入應用程式。同步推出的Arm AI Portal則提供單一入口,讓開發者尋找、評估及使用經過最佳化的模型、程式碼與工具。

CSS for Mobile 2反映行動晶片的競爭方向,正從單純比較CPU、GPU或NPU效能,轉向整體系統的協同運算能力。未來智慧型手機若要讓AI代理長時間在背景運作,同時兼顧即時回應、圖像品質、功耗與散熱,就不能只依賴單一AI加速器,而需要CPU、GPU及系統IP共同參與。

透過C2 CPU叢集與Mali G2-Ultra NX,Arm希望為晶片業者提供一套可快速導入的AI原生行動平台,也提前布局代理式AI與神經圖像可能帶來的下一波換機需求。

By 壹哥OneGeek1979

1979年出生於桃園, 2011年加入ETtoday新聞雲(Ettoday.net), 2019年創辦極熊仔,現為ETtoday新聞雲特約記者, 對新科技保持熱情,斜槓時尚包袋市場, 資訊爆炸時代,希望透過一點點趨勢觀點,為市場帶來更多正能量。

Leave ur Comment

探索更多來自 壹哥的科技生活 的內容

立即訂閱即可持續閱讀,還能取得所有封存文章。

繼續閱讀