8月27日英伟达首台Vera CPU服务器在西雅图交付AWS,八十八核瞄准智能体算力

不错!点赞

简介

英伟达Vera CPU是首款完全自主设计的数据中心CPU,专为智能体AI打造。8月27日,首台Vera CPU服务器在西雅图交付AWS,标志英伟达从GPU供应商扩张为覆盖CPU、GPU、网络与软件的全栈厂商。

2026年8月27日,英伟达首台Vera CPU服务器在西雅图由公司团队亲手交付给AWS,这一天被业界视为英伟达业务边界的一次实质性扩张。Vera是英伟达首款完全自主设计的数据中心CPU,与过去搭配GPU使用的Grace系列定位不同,它从设计之初就瞄准智能体AI——那种需要执行多步任务、持续调用工具而非单轮问答的工作负载。英伟达CFO Colette Kress此前对投资者表示,Vera CPU为公司打开了一个此前从未参与竞争的2000亿美元可及市场。这意味着英伟达正式从GPU供应商,走向同时覆盖CPU、GPU、网络与软件的全栈AI算力厂商。

一、事件速览

英伟达长期以GPU定义AI训练与推理的算力基准,但数据中心的计算任务从来不止于加速器。当AI从对话式问答走向智能体编排,调度、分支判断、工具调用、状态管理这一类串行逻辑大量回归CPU,传统通用CPU在带宽与并发结构上的短板被放大。Vera正是针对这一变化而设计:它搭载88个英伟达自研的Olympus核心,内存带宽达到1.2TB/s,整体架构围绕智能体编排产生的多分支代码模式优化,而非单纯追求单核频率。2026年8月27日交付AWS,是这款产品从图纸走向商业部署的第一个公开节点,也意味着全球最大的云厂商成为其首批用户之一。

二、关键数据与技术细节

  • 交付时间:2026年8月27日,地点为西雅图,英伟达团队亲手交付首台Vera CPU服务器给AWS。
  • 产品定位:英伟达首款完全自主设计的数据中心CPU,面向智能体AI而非传统通用计算。
  • 核心规格:搭载88个英伟达自研的Olympus核心,是Vera最核心的硬件标识。
  • 内存带宽:达到1.2TB/s,用于支撑智能体高频分支调度与状态读写。
  • 设计取向:围绕智能体编排产生的多分支代码模式优化,区别于单轮问答型负载。
  • 市场空间:英伟达CFO Colette Kress对投资者称,Vera CPU打开了公司此前从未参与竞争的2000亿美元可及市场。

三、行业影响与解读

Vera的落地改变了数据中心CPU市场的竞争图景。过去这一市场由x86架构长期主导,英伟达的角色更多是加速器供应商,CPU只是配套。而Vera以完全自主设计的姿态进入,配合英伟达已有的GPU、高速网络与CUDA软件栈,形成了一个纵向贯通的产品组合——客户采购的不再是一块卡,而是一整套可协同调优的算力系统。对AWS等超大规模云厂商而言,引入Vera既是对智能体负载的前置布局,也是对供应链多元化的现实选择。更深一层看,当智能体AI成为主流工作负载,算力的价值分配可能从单一加速器的峰值性能,转向CPU与加速器、内存与互联之间的系统级匹配效率,这正是英伟达全栈策略试图锁定的位置。业内普遍认为,这一动作也会促使传统CPU厂商加速在带宽与智能体场景上的跟进。

四、值得关注的信号

  • CPU重新成为AI竞争焦点:智能体多步任务让串行调度与分支逻辑回归核心,CPU赛道价值被重估。
  • 英伟达全栈化加速:从GPU扩展到CPU、网络与软件,客户绑定深度与切换成本同步上升。
  • 智能体负载定义硬件:多分支代码模式被写进架构设计,硬件定义方式正从算力峰值转向任务结构。
  • 云厂商态度成关键:AWS作为首批用户,其后续部署规模将直接影响Vera的商业化节奏。

小结:Vera CPU在西雅图交付AWS,是英伟达从加速器厂商迈向全栈算力平台的一个标志性节点。88个Olympus核心、1.2TB/s内存带宽与面向智能体的多分支设计,共同指向AI工作负载的结构性变化。2000亿美元的新增可及市场能否兑现,取决于智能体AI的落地速度与云厂商的部署决心,但CPU重回AI竞争中心已是明确信号。