开发者生态
morning
Arm发布Neoverse CSS N4:单裸片最高128核,押注智能体时代CPU需求
2026-09-08
1 阅读
约10分钟阅读
李冬梅
字号:
9月8日,在 Arm Everywhere China 年度大会上,Arm 发布新一代数据中心计算子系统 Neoverse CSS N4,并公布 Arm AGI CPU 的最新生态进展。与此同时,Arm 还宣布与新紫光集团深化合作,双方计划在中国成立联合通用人工智能创新中心。 随着AI应用从生成内容转向执行任务,一个智能体在完成推理之外,往往还要检索数据、访问数据库、调用外部工具,并与多个模型或其他智能体协同。这些操作不一定适合全部交给 GPU 处理,也由此增加了数据中心对通用 CPU、内存带宽和高速I/O的需求。 Arm试 图通过两条产品路线覆盖这一市场:Neoverse CSS N4 面向希望自行开发基础设施芯片的企业;Arm AGI CPU则是一款可以直接用于服务器系统的成品处理器。两者共享 Neoverse 平台和软件生态,但面向的客户和产品形态并不相同。 Neoverse CSS N4发布,单裸片最高128核 在今天的发布会上,Arm 宣布正式发布新品 Neoverse CSS N4。 CSS 是Compute Subsystem,即计算子系统。与单独授权CPU核心IP相比,CSS会预先集成CPU核心、互连、内存系统和相关系统IP,并完成部分验证工作。芯片企业可以在此基础上加入自己的加速器、网络模块或其他专用功能,减少从IP集成到芯片流片所需的工程工作。 因此,CSS N4本身不是一颗可以直接装进服务器的 CPU,而是一套供芯片厂商进行二次开发的计算子系统。 Arm 将 CSS N4 定位为其目前可配置程度最高的Neoverse CSS。 单颗裸片可以配置8至128个CPU核心,最高频率可达3.8GHz,并首次在Neoverse N系列CSS中支持LPDDR6内存和PCIe 7.0。 其中,PCIe通道数量最高可达128条,可以用于连接高速以太网设备、GPU和其他AI加速器。对于需要同时管理大量加速器、网络设备和存储资源的AI服务器而言,高速I/O能力的重要性正在上升。 按照 Arm公布的数据,与上一代 Neoverse CSS N3 相比,CSS N4的单插槽性能最高可提升至2倍,每瓦性能最高提升25%,内存带宽最高提升75%。这些数字均为Arm提供的代际比较结果,实际提升幅度仍将取决于芯片配置、制造工艺和具体工作负载。 CSS N4主要面向横向扩展计算、数据面处理、DPU、网络芯片和其他定制基础设施芯片。Arm还将Agent沙箱隔离、AI KV Cache处理和控制面计算列为目标场景。 在智能体系统中,沙箱用于将Agent执行的代码和工具调用与宿主系统隔离;DPU可以承接网络、安全和数据移动任务;KV Cache则保存模型推理过程中产生的中间状态。 随着Agent数量和并发任务增加,这些此前位于GPU周边的计算负载,可能进一步推高CPU、内存和网络资源的消耗。 鸿钧微电子是首批采用 CSS N4 开发基于 Arm 架构的差异化基础设施芯片的合作伙伴之一。 为什么智能体时代重新强调 CPU 过去几年,AI基础设施建设的主要关注点集中在GPU和其他加速器上。但GPU主要承担模型训练和推理中的大规模并行计算,完整的AI系统还需要CPU处理调度、网络、存储、数据库访问、模型服务以及各种传统应用。 进入智能体阶段后,这部分负载可能进一步增加。 一个AI Agent完成任务,通常不只运行一次模型推理。它可能需要反复规划步骤、搜索资料、调用API、执行代码、访问企业系统并验证结果。多个Agent同时运行时,还会产生大量并发执行、权限隔离和资源调度需求。 这也是Arm此次同时强调吞吐效率和响应性能的原因。大规模数据面和横向扩展任务更关注单位功耗下能够处理多少请求;工具调用、代码执行和交互式Agent则更依赖单线程性能、低延迟和稳定响应。 不过,这并不意味着CPU和GPU之间正在形成替代关系。更准确地说,Agent工作负载正在增加GPU之外的系统开销,使CPU、内存、网络和加速器之间的协同变得更加重要。 与CSS N4不同,Arm AGI CPU不是在本次大会上首次推出。 Arm 于 2026年3月正式发布 AGI CPU,这是 Arm 从授权 CPU 架构和 IP 进一步进入数据中心成品芯片市场后的首款产品。该处理器采用Neoverse V3核心,单颗最多配置136个核心,支持12通道DDR5内存、96条PCIe 6.0通道和CXL 3.0,TDP为300W。 这款“AGI CPU”它实际承担的是 AI 服务器中的通用计算和编排任务,例如协调加速器、处理数据移动、运行Agent工具以及承载传统云服务。 此外,在本次大会上,Arm 主要披露了AGI CPU在中国市场及全球生态中的后续进展。 Arm称,OpenAI、Meta、Cloudflare、Oracle、SAP、联想、Supermicro和Verda等公司正在围绕这款 CPU 开发相关系统或解决方案。 火山引擎将推出基于AGI CPU的Agent沙箱 在国内市场,火山引擎正在基于Arm平台建设下一代云服务,并计划推出首批采用Arm AGI CPU的智能体沙箱解决方案。 Agent沙箱可以为AI生成的代码、工具调用和自动化任务提供相互隔离的运行环境。当企业同时运行大量Agent时,沙箱需要支持快速启动、权限控制、弹性扩容和故障隔离,因此会消耗较多CPU与内存资源。 火山引擎云基础产品经理负责人李越渊表示,其对Arm AGI CPU的早期评估显示,这款处理器在主流云工作负载中具有一定的性能潜力。这里的表述仍属于合作伙伴的早期评估,双方暂未公布具体测试方法、性能数据和产品上线时间。 类似的Agent基础设施也已经出现在其他云平台中。Google Cloud在基于Axion处理器的GKE环境中部署了Agentic Sandbox;微软Azure使用Cobalt 200处理器支持Agent沙箱中的工具调用和代码执行;NVIDIA Vera CPU也将Agent编排和加速器协同作为目标负载之一。 这些进展说明,智能体基础设施的竞争已经不再局限于“哪颗GPU完成模型推理更快”,而是开始扩展到谁能更有效地承接模型周边的执行任务。 面向未来,筑就下一代技术根基 Arm 也正在与新紫光集团深化战略合作,共同推动中国下一代 AI 基础设施的发展。双方的合作将涵盖 Arm AGI CPU 和 Arm 计算子系统(CSS)等 Arm 技术。 结合 Arm 在高能效计算及全球软件生态系统方面的领先优势,以及新紫光集团在芯片设计、系统开发和中国市场方面的能力积累,双方还计划在中国成立联合通用人工智能创新中心,围绕 AI 智能体编排、CXL 内存池化、机架级系统架构以及边缘 AI 等技术方向开展探索与创新,致力于打造面向中国市场、具有差异化优势、覆盖多代演进路线图的 AI 基础设施解决方案体系。 智能体 AI 仍处于发展初期。随着智能体应用大量普及,基础设施需要处理更多数据、协同/调度更多加速器,并支持更大规模的并发计算。因此,如何从每一瓦电力、每个机架以及每一笔投资中释放最大价值,变得愈发重要。 整个行业正逐步将 Arm 作为下一代智能体 AI 的通用计算平台。借助
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱