ADVERTISEMENT
Arm CSS for Mobile 2運算子系統包含C2-Ultra、C2-Pro等CPU以及SME2單元,強化通用與AI運算效能,帶來更豐富的語音處理、資訊檢索、AI推論等使用體驗。
強化AI效能、相容TSMC N2製程
Arm邊緣AI CPU產品管理總監Daniel Lu於北京舉辦的Arm Tech Day 2026說明會上詳細介紹CSS for Mobile 2運算子系統的CPU(處理器)特色,其中包含C2-Ultra、C2-Pro等CPU核心,以及能夠強化AI運算效能的SME2(Scalable Matrix Extension 2,第2代可擴展矩陣延伸指令集)運算單元,最高能夠帶來15%、12%單、多執行緒效提升以及1.7倍AI推論效能,強化代理式AI工作流程各環節的表現同時更快的網頁瀏覽和應用程式啟動速度,進一步縮短了存取服務與執行任務花費的時間。
延伸閱讀:
Arm Lumex CSS平台搭配全新C1系列處理器,4種型號隨意混搭最高14核心效能怪獸
Arm發表全新Lumex CSS平台,C1 CPU與Mali G1 GPU為旗艦級手機帶來25%效能增長
Arm發表類神經網路升頻技術,NPU嵌入GPU藉AI提升繪圖效能並節省電力
CSS for Mobile 2運算子系統的開發重點包含強化代理式AI的效能,以因應行動裝置的AI功能逐漸進化為AI原生行為的趨勢,使用者不再需要手動操作、輸入指令與裝置互動,而是可以透過語音直接指揮裝置完成多種工作。
在製程技術方面,Arm表示CSS for Mobile 2最高能夠支援TSMC(台積電)N2節點製程,並且也可搭配其他晶圓廠之製程(筆者注:應指Intel與Samsung)。
考量行動裝置的電源與散熱預算相當有限,裝置尺寸能容納的晶片面積也很有限,不能完全參考筆記型電腦、桌上型電腦可以搭配規模更大的GPU(繪圖處理器)或NPU(神經處理器)來改善A I運算,因此使用CPU進行A I運算就相當重要。
相較於GPU或NPU而言,CPU雖然的A I運算效能沒那麼突出,但是有著可以完全程式化的優勢,當出現使用新的資料類型精度的AI模型時,CPU只需透過更新軟體方式就能支援,而且CPU具有最高的普及率(99%的行動裝置搭載Arm架構CPU),並搭配SME2引擎加速A I運算(較舊的CPU則可使用NENO指令集),具有比更高的相容性與程式的可移植性。
另一方面在CPU中進行AI運算,也有著不必將資料搬遷到外部運算單元的優勢,能夠縮小A I運算的延遲,提供更靈敏的使用體驗。
而與在雲端進行AI運算相比,在本機CPU執行有著資料不必往外傳輸的資安優勢,尤其對於需要處理更多行事曆、照片、通訊錄等個資的情境,具有更高的安全性。














C2-Ultra如何改善代理式AI效能
Daniel Lu以丈夫為妻子訂結婚10週年紀念晚餐的任務說明代理式AI的在4個階斷的運作流程,以及執行的工作內容,並與前代產品進行效能對照。筆者於下分列出運作流程,搭配圖文方式說明。
代理式AI運作流程
- 感知(Perceive):接收外界資訊並分析指令。例如使用者對手機說「幫我訂結婚10週年餐廳」
- 記憶(Remember):搜尋資訊與過去的互動。系統會搜尋手機中的行事曆、相簿等資料,確定結婚紀念日期,以及從過去的相片分析喜歡的餐廳風格與菜色
- 推理(Reason):規劃並決定最佳解決方案。系統自動上網搜尋適合的餐廳,並生成操作提示詞
- 行動(Act):自動執行提示詞與任務。系統自動完成餐訂位,將行程新增至行事曆,將活動提醒與導航資訊傳給妻子
在上述流程中,除了會進行AI推論運算之外,還有許多查尋資料、開啟App、操作網頁的工作,都會占用CPU的運算資源,而且統整各階段順利進行的編排(Orchestration)工作也仰賴CPU。








CSS for Mobile 2擁有完善的軟體生態系,搭配KleidiAI API能為軟體提供最佳化執行路徑,並充分發揮SME2的效能優勢,透過完整的軟體堆疊帶來更好的效能與使用體驗。
筆者將於下篇文章繼續介紹G2-Ultra NX,請讀者參考下方連結回到系列文章目錄。
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!