Arm发布Neoverse CSS N4:智能体时代,CPU重新成为基础设施主角
导语
在智能体从“回答问题”走向“执行任务”的过程中,AI基础设施的瓶颈不再只由模型推理速度决定。检索数据、调用API、运行代码、访问数据库以及协调多个智能体,都会带来大量通用计算、内存和网络开销。Arm此次发布Neoverse CSS N4,并同步披露Arm AGI CPU的生态进展,正是对这一变化的回应。
核心要点
- CSS N4面向芯片定制。 CSS,即计算子系统,会预先集成CPU核心、互连、内存系统和相关系统IP。芯片企业可以在此基础上加入加速器、网络模块等组件,因此它不是可直接部署的服务器CPU,而是用于二次开发的基础模块。
- 规格强调扩展能力。 CSS N4单颗裸片可配置8至128个核心,最高频率达3.8GHz,并在Neoverse N系列CSS中首次支持LPDDR6和PCIe 7.0。PCIe通道最多128条,可连接GPU、高速网络设备及其他加速器。
- 性能数据需结合场景理解。 Arm称,相比CSS N3,CSS N4单插槽性能最高提升至2倍,单位功耗性能最高提升25%,内存带宽最高提升75%。这些是厂商给出的代际比较,最终表现仍取决于芯片配置、制造工艺和工作负载。
- 两条产品路线覆盖不同客户。 CSS N4服务于希望自行打造基础设施芯片的企业;Arm AGI CPU则是可直接用于服务器系统的成品处理器。后者采用Neoverse V3核心,最多136核,并支持DDR5、PCIe 6.0和CXL 3.0。
为什么CPU重新受到重视
GPU仍然负责训练和推理中的大规模并行计算,但智能体任务往往包含许多串行或交互式环节。规划下一步行动、验证结果、控制权限、启动沙箱、传输数据和调度加速器,都需要CPU参与。多个智能体并发运行时,资源隔离、快速启动和故障控制又会进一步放大这类需求。
因此,Arm将Agent沙箱、KV Cache处理、DPU和控制面计算列为CSS N4的目标场景,逻辑并不是用CPU替代GPU,而是补足GPU周边的系统能力。高性能CPU、足够的内存带宽和更多高速I/O,可以帮助服务器减少数据搬运与调度瓶颈。
产业影响
火山引擎计划基于Arm AGI CPU推出智能体沙箱方案,Arm还披露了OpenAI、Meta、Cloudflare、Oracle、SAP、联想、Supermicro和Verda等生态参与者。需要注意的是,部分合作仍处于开发或早期评估阶段,公开信息尚不足以证明具体产品的最终性能和上市时间。
Arm与新紫光集团还计划在中国成立联合通用人工智能创新中心,探索智能体编排、CXL内存池化、机架级系统和边缘AI等方向。整体来看,智能体基础设施的竞争正在从“谁的GPU更快”扩展为“谁能更高效地组织CPU、内存、网络与加速器”。这也为定制芯片和能效优化带来新的机会。
来源:InfoQ 中文
评论
正在确认登录状态……
正在加载评论……