2026年9月8日,Arm公司在上海成功举办Arm Everywhere China年度大会。本次大会主题设为“赋能AI计算的未来”,近2000名来自产业链上下游的行业领袖、开发者及生态伙伴齐聚一堂,共同探讨智能体时代的计算创新与产业发展机遇。


按照Arm官方的说法,Arm全球合作伙伴累计出货的基于Arm技术的芯片已超过3500亿颗,而当前计算产业正从以生成式人工智能为主导的时代迈向智能体时代。未来的计算不会局限于单一场景,而是横跨边缘、物理世界和云,形成一个高度互联的计算连续体。在边缘侧,智能更加个性化;在物理世界中,智能付诸行动;在云端,智能得以诞生。这一趋势带来了系统级挑战:工作负载变得更加分布式;模型和计算需求日趋多样化;系统愈发异构和自主;软件环境也各不相同……具体到细节上,未来的AI体验不再由单一AI工作负载或单个处理器定义,而是需要让AI运行在最适合特定任务的计算引擎之上。

会上,Arm推出全新的第二代移动终端计算子系统Arm CSS for Mobile 2,这也是首个AI原生移动计算平台,它集成了最新的搭载SME2的Arm C2 CPU集群与首个AI原生的GPU:Mali G2-Ultra NX,具备增强型系统IP、物理实现方案以及开发者就绪的软件生态系统,并针对下一代移动设备进行了全面优化。这意味着它能在单一计算平台中,实现对智能体AI和AI生图形技术的全面支持。

Arm官方表示,智能体AI和神经图形技术正在重塑移动设备的能力需求,而AI原生的CSS for Mobile 2正是Arm针对这一趋势打造的新一代计算平台。下一代移动AI体验将不再由单一加速器来定义,而是通过在统一优化的系统中融合各类AI能力,共同打造全新的移动体验!



这一次,全新的Arm C2 CPU集群结合了Arm史上性能最强劲的C2-Ultra、面向能效优化的C2-Pro CPU,以及双SME2单元。这一设计使AI工作负载能够直接在CPU上实现高响应、低延迟处理,同时与各类AI加速器无缝协同工作。
C2 CPU集群配置了翻倍的SME2计算能力,可使最新小语言模型的运行速度提升高达70%,进一步增强CPU对AI工作负载的加速能力。与上一代C1-Ultra相比,C2-Ultra可实现高达1.7倍的AI性能提升和15%的单线程性能提升;相同性能下,还可节省38%的功耗。



首款集成专用神经网络加速器的Arm Mali G2-Ultra NX,基于AI原生图形技术,Arm Mali G2-Ultra NX的图形处理与神经网络计算单元可在同一处理管线中协同运行,使相关工作负载直接在GPU内完成,实现更高的能效和响应速度,也为开发者在性能、能效与视觉质量之间进行权衡和优化提供了全新方式。同时,该GPU还引入全新的执行引擎(Execution Engine,EE)和第三代光线追踪单元(Ray Tracing Unit v3,RTUv3),专为日益复杂的图形工作负载以及现代游戏引擎功能而设计。据Arm官方透露,结合Arm神经网络技术,Mali G2-Ultra NX在神经网络处理场景下可实现最高4倍的每瓦性能提升,以及现有游戏内容中高达14%的性能提升(与上一代产品相比)。





会上,由Arm与Sumo Digital联合开发的《光影新生》展示了Mali G2-Ultra NX所能带来的全新图形体验。同时,多家领先游戏引擎和平台宣布已将Arm神经网络技术集成到开发流程中,包括腾讯游戏公共技术线的Magic Dawn和Unity中国团结引擎。网易《燕云十六声》计划于今年向玩家推出支持神经超级采样(Neural Super Sampling,NSS)的版本。

此外,Arm还联合腾讯游戏《暗区突围:无限》开展神经超级采样与降噪(Neural Super Sampling and Denoising,NSSD)技术演示,并与游戏《无限暖暖》推进NSS技术集成。
值得一提的是,CSS for Mobile 2建立在Arm持续投入AI软件生态系统的基础之上,从KleidiAI到Arm神经图形开发套件(Arm Neural Graphics Development Kit),还有全新的AI Portal为开发者和智能体提供单一入口,用于发现、评估和使用经过优化的模型、代码和工具。可以说,CSS for Mobile 2平台是专为下一代边缘AI而生——于芯片合作伙伴而言,这意味着能够更快速地打造差异化产品;对于开发者而言,则能够基于统一平台规模化开发和部署AI应用;对于终端用户而言,则可获得更灵敏、更个性化且更丰富的视觉体验。凭借业界领先的每瓦性能,涵盖IP、计算子系统和芯片产品的灵活选择,以及由超过2200万名开发者构建的强大软件生态系统,Arm正持续推动AI智能的无处不在。




在移动领域之外,Arm还在不断向物理AI、AI基础设施乃至更广泛的AI生态系统探索。比如他们正将成熟的Arm全面设计(Arm Total Design)生态项目扩展至物理AI领域。其首项重点协作倡议聚焦于构建机器人能力分级框架(Robotics Capability Framework),旨在建立一套统一的语言,用于描述、评估和交流自主机器的能力发展水平。


而AI基础设施方面,Arm还为芯片合作伙伴提供了迄今可配置性最高的Neoverse CSS N4以及可直接部署的高性能Arm AGI CPU。两者均构建于统一的Neoverse平台和软件生态系统之上。合作伙伴可围绕不同用例进行灵活配置,同时降低工程投入和集成风险,并缩短芯片开发周期。



其中,Neoverse CSS N4单颗裸片(Die)最高可搭载128个内核,支持LPDDR6内存与PCIe Gen 7互连。与Neoverse CSS N3相比,其性能最高可提升至两倍,每瓦性能提升1.25倍,内存带宽最高提升1.75倍。



据官方介绍,在更广泛的云生态系统中,众多企业已开始借助Arm平台支撑智能体AI应用的发展。Google Cloud已在基于Axion的GKE环境中部署智能体沙箱;Microsoft Azure利用Cobalt 200加速智能体沙箱中的工具调用与执行;NVIDIA Vera则面向智能体工作负载进行了专门优化。字节跳动旗下云计算业务火山引擎正在基于Arm平台构建其下一代云服务,并将首批基于Arm AGI CPU的智能体沙箱解决方案推向市场,为大规模智能体工作负载提供安全、弹性可扩展的运行环境。Arm也正在与新紫光集团深化战略合作,共同推动中国下一代AI基础设施的发展。


