9月9日,Arm 在 Everywhere China 年度大会推出第二代移动终端计算子系统 CSS for Mobile 2,并在同一平台首次为「智能体 AI」与「AI 原生图形」留出专用加速通路;同日发布面向云、网络与智能体 AI 工作负载的 Neoverse CSS N4(代号 Ranger,128 核,采用 TSMC N3P 工艺)。

一、端侧 Agent 有了底层加速

CSS for Mobile 2 中的 Mali G2-Ultra NX GPU 是首款集成专用神经网络加速器的 Mali GPU,神经网络场景每瓦性能最高提升 4 倍;C2 CPU 集群的 SME2 算力翻倍,使小语言模型在端侧运行速度最高提升 70%。这意味着手机本地跑多步 Agent 任务的算力与功耗瓶颈,将在下一代 SoC 周期显著缓解。

二、云侧也补上智能体负载

Neoverse CSS N4 瞄准的是云、网络与智能体 AI 这类高并发、长时运行的工作负载,128 核设计直接服务于数据中心与边缘推理节点。端(Mobile 2)与云(Neoverse N4)同步升级,构成一条从口袋到机房的智能体算力链路。

三、客观看点:芯片与模型开始「对齐」

底层指令集与 GPU 为端侧 Agent 专门留出加速通路,与面壁 MiniCPM5-2B 等小参数端侧模型形成「芯片+模型」的闭环呼应。端侧智能体基建正在加速成型——对开发者,未来在手机上跑一个常驻、低功耗、数据不出的 Agent,不再是极限调优,而是平台默认能力。但能效提升最终要落到真实应用续航与稳定性上,纸面倍数仍需终端产品验证。