新闻笔记 · IDAEO AI News

进军AI服务器CPU市场!辉达Vera正式出货 直攻英特尔、超微地盘
#AI芯片

进军AI服务器CPU市场!辉达Vera正式出货 直攻英特尔、超微地盘

发布者:

TL;DR · 这代表什么

这代表辉达正通过自研CPU抢夺服务器市场,减低客户对英特尔与超微的依赖。

相关实体 News Cnyes

新闻正文

辉达 (NVDA-US) 凭借人工智能 (AI) 加速器需求跃升为全球市值最高企业,如今进一步将战线从绘图处理器 (GPU) 延伸至中央处理器 (CPU),试图挑战长期主导服务器市场的英特尔 (INTC-US) 与超微 (AMD-US)。 辉达周二 (21 日) 公布新一代数据中心 CPU「Vera」的详细规格、架构及性能测试信息,让潜在客户评估产品。 公司代表表示,Vera 芯片已于 6 月交付 OpenAI、Anthropic 与 SpaceX(SPCX-US) 等客户,OpenAI 更计划从本季起大规模部署。 辉达正通过垂直集成策略,逐年增加自行开发的芯片与系统技术,不再只销售单颗 GPU,而是提供整座机柜的完整运算能力。

公司认为,集成 CPU、GPU、内存及网络技术,可让工程师进一步释放 GPU 性能,使辉达系统在超微加速器与客制化 AI 芯片竞争升温之际,继续成为顶尖 AI 实验室的首选。 代理式 AI 拉高 CPU 需求 辉达估市场上看 2,000 亿美元在 AI 热潮出现前,CPU 原本是服务器中最重要且昂贵的零组件。 ChatGPT 于 2022 年推出时,第一代 AI 服务器通常以一颗 CPU 搭配最多 8 颗 GPU,产业重心因而逐渐转向辉达加速器。 不过,能以极少人为介入、在背景自主运行任务的代理式 AI 兴起后,CPU 的重要性再度提升。

CPU 必须管理 AI 代理并持续供应数据,其处理单一问题的速度将直接影响昂贵 GPU 的利用率。 辉达超大规模运算事业副总裁巴克 (Ian Buck) 表示,代理式 AI 使 CPU 成为系统中更不可或缺的一环,尤其是 CPU 回答单一问题的速度。 金融市场已开始反映这项趋势。 超微与英特尔今年股价分别大涨 128% 及 149%,明显超越辉达的 8% 涨幅。 辉达估计,整体服务器 CPU 市场最终规模可能达到 2,000 亿美元;Bernstein 则估计,2025 年成熟服务器 CPU 市场规模约为 370 亿美元。

目前英特尔约占服务器 CPU 市场 66.8%,超微占约 33%,但超微持续扩大市占率,并与大型云端服务业者创建深厚合作关系。 Gartner 分析师 Kevin Knox 认为,超微是目前企业 AI 服务器 CPU 市场最需要击败的对手。 Wolfe Research 预估,每颗 Vera 平均售价约 5,000 美元,辉达今年可能出货约 130 万颗,但辉达拒绝评论价格。 主打宏内核性能 Vera 称代理式 AI 性能高出 x86 芯片 50%Vera 是辉达首款从处理器内核开始自行设计的服务器 CPU,不再直接采用 Arm 提供的现成内核设计。

其自研 Olympus 内核锁定代理式 AI 的运算瓶颈,主打宏内核速度、内存带宽及低延迟,有别于英特尔与超微近年着重增加内核数量的设计方向。 辉达宣称,Vera 运行代理式 AI 工作的性能比英特尔及超微采用的 x86 芯片高出 50%。 Vera 产品行销主管 Hannah Coutand 表示,提高每个内核的速度,可让 AI 代理更快把工作交还给 GPU,使 AI 工厂中昂贵且高价值的 GPU 维持更高使用率。 Vera 可单独销售,也可组成搭载 256 颗芯片的液冷机柜,或以两颗 Vera 配置於单一服务器。 这款 CPU 也将与辉达 GPU 集成,组成新一代 Vera Rubin 平台。

Vera 功耗介于 250 瓦至 450 瓦,并采用笔电与手机常见的低功耗内存,每颗芯片最高支持 1.5TB 容量。 分析师认为,Vera 并非用于网站服务等传统工作,而是专门处理高强度 AI 任务,形成英特尔与超微目前尚未直接涵盖的新 CPU 类别。 不过,即使辉达在 AI 市场占有优势,说服云端服务商采用 Vera 仍是一大考验。 公司坦言产品仍处于导入初期,目前公布的主要云端合作伙伴仅有甲骨文 (ORCL-US)。 Cambrian AI Research 创办人 Karl Freund 认为,辉达开发 Vera 的目的,是让客户不再依赖英特尔或超微 CPU,同时取得这部分服务器营收。

数字与意义

50%

辉达宣称Vera运行代理式AI工作的性能比英特尔及超微的x86芯片高出50%

常见问题(FAQ)

Vera CPU的主要特點是什麼?

採用自研Olympus核心,專注單一執行緒效能與低延遲,針對AI代理工作負載優化。

Vera應用於哪些場景?

主要用於AI研究實驗室與大型雲端資料中心,執行AI推論與代理任務處理。

Vera與傳統CPU有何不同?

重視單核心效能而非核心數量,採用Arm架構,專為AI工作負載設計,擺脫x86依賴。

今日小测

辉达宣称Vera的代理式AI性能相比x86芯片高出多少?