新闻正文
随着AI快速迈向代理式 AI (Agentic AI)时代,Arm 扩大与辉达(NVDA-US)合作,从运行 AI 代理所需的 CPU,到负责监控、隔离与安全防护的数据处理单元(DPU),共同布局新一代 AI 基础设施,抢攻代理式 AI 带动的运算与资安商机。
Arm 指出,AI 基础设施正持续朝 Arm 架构发展,目前旗下技术已部署于主要超大规模云端服务供应商平台。随着 AI 代理从单纯生成内容,进一步具备持续运作、调用工具、访问数据及自主运行任务等能力,对运算性能以及安全机制的需求也同步提升。
相较过去生成式 AI 主要负责回应用户指令,代理式 AI 能够长时间运行,甚至同时启动多个代理协同完成任务,也让 CPU 在 AI 基础设施中的角色更加重要,包括代理运行环境、代理框架、任务编排系统、工具运行及相关应用,都需要 CPU 提供运算资源。
Arm 目前已是多家云端与 AI 业者的 CPU 平台架构,包括 Amazon Graviton、Google Axion、Microsoft Cobalt,以及辉达客制化开发的 Vera CPU 等,皆创建在 Arm 软件生态系之上。
其中,辉达最新推出的 NVIDIA Open Agent Safety Platform,也进一步结合 Arm 运算架构。旗下 OpenShell 可为 AI 代理创建安全运行边界,限制代理可访问的资源与可运行的动作,并将相关安全能力延伸至 Arm CPU 生态系。
Arm 表示,代理式 AI 除了需要足够的运算能力运行工作负载,也需要另一套独立于 AI 代理本身之外的运算环境,负责持续监控代理行为、运行安全策略,以及在发生异常时进行隔离,这也成为 DPU 与基础设施处理器的重要应用场景。
基于 Arm 架构的 DPU 可将网络、监控、隔离及安全等功能从主机 CPU 中分离,形成独立的控制层,使安全机制不必依赖 AI 代理或应用本身,即可持续运行。
辉达 BlueField 即采取此一架构。BlueField-4 采用由 64 个 Arm Neoverse V2 内核驱动的 NVIDIA Grace,可在主机之外创建独立的基础设施环境,并通过 OpenShell 与 NVIDIA Sentry 协同运作,将安全策略运行能力延伸至独立信任域。
其中,NVIDIA Sentry 可持续监控 AI 代理行为,一旦发现不安全或异常状况,即可进行隔离,让基础设施与网络安全控制得以独立于 AI 代理本身运作。
随着代理式 AI 应用规模持续扩大,Arm 与辉达的合作也从单纯的 CPU 运算进一步延伸至 DPU 与安全基础设施。整体架构由 Arm CPU 负责承载与运行 AI 代理工作负载,再由基于 Arm 架构的 DPU 负责监控、管控及隔离,形成涵盖运算与安全两端的代理式 AI 基础设施布局。